web-archive
Archive-It (Internet Archive)
Der abonnementbasierte Archivierungsdienst des Internet Archive, genutzt von mehr als tausend Bibliotheken, Behörden und Universitäten, um kuratierte Web-Sammlungen aufzubauen, die zusammen mehrere zehn Milliarden Dokumente umfassen. Captures werden über Replay-Links auf wayback.archive-it.org angesehen, nach Sammlung geordnet. Es zahlt sich aus, wenn die Sammlung einer bestimmten Institution Ihr Thema abdeckt; die Abdeckung erfolgt sammlungsweise, es ist also nicht der Ort, um beliebige URLs nachzuschlagen.
Keine programmatische Prüfung, öffnet die eigene Suche des Archivs.
Warum es nützlich ist & wie es funktioniert
Auf Archive-It bauen Institutionen wie Universitäten, Behörden und Bibliotheken ihre eigenen thematisch fokussierten Web-Sammlungen auf und pflegen sie; der Dienst glänzt daher, wenn Ihr Gegenstand in das Sammelgebiet einer bestimmten Organisation fällt. Über 1.000 Partnerinstitutionen weltweit haben mehr als 10.000 öffentliche Sammlungen angelegt, die alle auf archive-it.org im Volltext durchsuchbar sind. Sie können nach Organisation oder Thema stöbern und Captures anschließend über eine Replay-Ansicht im Stil der Wayback Machine ansehen. Da die Abdeckung von Sammlung zu Sammlung unterschiedlich ist, funktioniert der Dienst am besten, wenn Sie eine einschlägige Sammlung identifiziert haben, und weniger bei der Suche nach einer beliebigen URL.
Was drinsteckt
Die Partner haben gemeinsam mehrere zehn Milliarden Dokumente archiviert. Der Dienst wächst seit 2006, und die kombinierten Bestände bewegen sich im Petabyte-Maßstab; eine eigene Gesamtzahl getrennt vom übrigen Internet Archive wird jedoch nicht veröffentlicht.
API-Zugang
Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.
Was wir gemessen haben
Unsere eigenen Messungen, nicht die Angaben des Archivs. Sie werden regelmäßig wiederholt; jeder Wert ist datiert.
Erreichbarkeit
- Direkte Anfrage
- Hat geantwortet HTTP 200 574 ms
- Über einen Rechenzentrums-Proxy
- Hat geantwortet HTTP 200 1,1 s
- All CDX, direkt
- Blockiert HTTP 403 325 ms
- All CDX, über Proxy
- Blockiert HTTP 403 927 ms
- Collection 2950 CDX, direkt
- Hat geantwortet HTTP 200 323 ms
- Collection 2950 CDX, über Proxy
- Hat geantwortet HTTP 200 1,1 s
- Collection 2950 replay, direkt
- Hat geantwortet HTTP 200 828 ms
- Collection 2950 replay, über Proxy
- Hat geantwortet HTTP 200 1,6 s
Hat eine echte Suche etwas geliefert?
Nicht eindeutig · Median 840 ms · über Läufe hinweg stabil
The per-collection CDX endpoint now answers with a "Session Verification" interstitial rather than JSON, so nothing can be counted. Coverage was always collection-specific and empty for arbitrary URLs: treat as link-only unless a collection is known.
Erreichbarkeit gemessen am 2026-08-22. Suche geprüft am 2026-08-22.
Zugang
Programmatischer Zugriff über eine API (ggf. mit Schlüssel, siehe API-Kennzeichnung).