web-archive
Wayback Machine (Internet Archive)
L'archive de pages web phare d'Internet Archive et la plus vaste de son genre, qui conserve plus de mille milliards de captures d'URL telles qu'elles se présentaient au fil du temps. Saisissez n'importe quelle adresse web pour parcourir son historique d'instantanés dans l'interface web ; des API gratuites permettent également de vérifier si une page est archivée et de lister chaque capture. C'est le premier réflexe lorsqu'il vous faut une version ancienne ou supprimée de presque n'importe quelle page web. Le service a connu des interruptions intermittentes en 2026 et bride les usages intensifs, mais les captures existantes restent consultables.
Son utilité et son fonctionnement
Pensez d'abord à la Wayback Machine dès que vous cherchez une version ancienne ou supprimée de presque n'importe quelle page web publique. Saisissez une URL sur web.archive.org et un calendrier affiche toutes les dates auxquelles un instantané a été pris ; choisissez une date pour parcourir la page telle qu'elle apparaissait ce jour-là, liens internes fonctionnels compris. Le service propose aussi une API gratuite et sans clé pour vérifier si une URL est archivée et pour lister toutes les captures d'une adresse, ce qui facilite son intégration dans des flux de travail de recherche. À noter que certains éditeurs de presse ont restreint les nouveaux moissonnages, sans que cela n'affecte les captures existantes.
Ce qu’elle contient
Plus de mille milliards de pages web capturées depuis 1996, un cap franchi en octobre 2025. La collection représente environ 99 pétaoctets de données uniques, et dépasse 212 pétaoctets sauvegardes comprises ; elle s'enrichit de plusieurs centaines de millions de pages par jour.
Accès API
Availability https://archive.org/wayback/available?url= ; CDX http://web.archive.org/cdx/search/cdx?url=&output=json ; TimeMap http://web.archive.org/web/timemap/link/ ; replay https://web.archive.org/web/ <ts>/<url>
Accès
Librement accessible : sans clé, sans compte ni captcha.