web-archive
Wayback Machine (Internet Archive)
Das zentrale Webseiten-Archiv des Internet Archive und das größte seiner Art; es enthält mehr als eine Billion Captures von URLs in ihrem jeweiligen zeitlichen Zustand. Geben Sie eine beliebige Webadresse ein, um deren Snapshot-Verlauf in der Weboberfläche zu durchsehen; kostenlose APIs erlauben außerdem die Prüfung, ob eine Seite archiviert ist, und die Auflistung aller Captures. Sie ist die standardmäßige erste Anlaufstelle, wenn Sie eine alte oder gelöschte Fassung nahezu jeder Webseite benötigen. Der Dienst hatte 2026 zeitweise Ausfälle und drosselt intensive Nutzung, bestehende Captures bleiben jedoch lesbar.
Warum es nützlich ist & wie es funktioniert
Greifen Sie zuerst zur Wayback Machine, wenn Sie eine alte oder gelöschte Fassung nahezu jeder öffentlichen Webseite benötigen. Geben Sie auf web.archive.org eine URL ein, und ein Kalender zeigt jedes Datum an, zu dem ein Snapshot angelegt wurde; wählen Sie ein Datum, um die Seite so zu durchsehen, wie sie an diesem Tag aussah – samt funktionierender interner Links. Zusätzlich steht eine kostenlose API ohne Schlüssel bereit, mit der sich prüfen lässt, ob eine URL archiviert ist, und mit der sich alle Captures einer Adresse auflisten lassen; das erleichtert die Einbindung in Forschungsabläufe. Beachten Sie, dass einige Nachrichtenverlage neues Crawling eingeschränkt haben, was bestehende Captures jedoch nicht betrifft.
Was drinsteckt
Seit 1996 wurden über eine Billion Webseiten erfasst – ein Meilenstein, der im Oktober 2025 erreicht wurde. Die Sammlung umfasst rund 99 Petabyte an eindeutigen Daten, einschließlich Sicherungskopien über 212 Petabyte, und wächst täglich um Hunderte Millionen Seiten.
API-Zugang
Availability https://archive.org/wayback/available?url= ; CDX http://web.archive.org/cdx/search/cdx?url=&output=json ; TimeMap http://web.archive.org/web/timemap/link/ ; replay https://web.archive.org/web/ <ts>/<url>
Zugang
Frei erreichbar – ohne Schlüssel, Anmeldung oder Captcha.