Archivarix

web-archive

Archive-It (Internet Archive)

Der abonnementbasierte Archivierungsdienst des Internet Archive, genutzt von mehr als tausend Bibliotheken, Behörden und Universitäten, um kuratierte Web-Sammlungen aufzubauen, die zusammen mehrere zehn Milliarden Dokumente umfassen. Captures werden über Replay-Links auf wayback.archive-it.org angesehen, nach Sammlung geordnet. Es zahlt sich aus, wenn die Sammlung einer bestimmten Institution Ihr Thema abdeckt; die Abdeckung erfolgt sammlungsweise, es ist also nicht der Ort, um beliebige URLs nachzuschlagen.

Webseiten und Websites
Dieses Archiv durchsuchen

Keine programmatische Prüfung, öffnet die eigene Suche des Archivs.

Warum es nützlich ist & wie es funktioniert

Auf Archive-It bauen Institutionen wie Universitäten, Behörden und Bibliotheken ihre eigenen thematisch fokussierten Web-Sammlungen auf und pflegen sie; der Dienst glänzt daher, wenn Ihr Gegenstand in das Sammelgebiet einer bestimmten Organisation fällt. Über 1.000 Partnerinstitutionen weltweit haben mehr als 10.000 öffentliche Sammlungen angelegt, die alle auf archive-it.org im Volltext durchsuchbar sind. Sie können nach Organisation oder Thema stöbern und Captures anschließend über eine Replay-Ansicht im Stil der Wayback Machine ansehen. Da die Abdeckung von Sammlung zu Sammlung unterschiedlich ist, funktioniert der Dienst am besten, wenn Sie eine einschlägige Sammlung identifiziert haben, und weniger bei der Suche nach einer beliebigen URL.

Was drinsteckt

Die Partner haben gemeinsam mehrere zehn Milliarden Dokumente archiviert. Der Dienst wächst seit 2006, und die kombinierten Bestände bewegen sich im Petabyte-Maßstab; eine eigene Gesamtzahl getrennt vom übrigen Internet Archive wird jedoch nicht veröffentlicht.

API-Zugang

Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.

Zugang

Programmatischer Zugriff über eine API (ggf. mit Schlüssel, siehe API-Kennzeichnung).

Startseite

https://archive-it.org/

Ähnliche Archive