Archivarix

web-archive

Library of Congress Web Archives

Das kuratierte Web-Archivierungsprogramm der Library of Congress: mehr als hundert thematische Sammlungen von Websites, ausgewählt von ihren Bibliothekaren, im Petabyte-Maßstab. Sie durchsehen die Sammlungen auf loc.gov; Sammlungs- und Objektseiten lassen sich auch als JSON abrufen. Es spielt seine Stärken aus, wenn Ihr Thema zu einem der kuratierten Schwerpunkte passt – Wahlen, Ereignisse, Organisationen – weniger beim Nachschlagen beliebiger URLs.

Webseiten und Websites API

Warum es nützlich ist & wie es funktioniert

Das Web-Archiv der Library of Congress lohnt sich für Forschende, deren Thema zu einem der kuratierten Schwerpunkte passt: Wahlen, bedeutende Ereignisse, Regierungsprogramme, Kulturorganisationen und ähnliche Gegenstände, ausgewählt von den Bibliothekaren der LoC. Sie durchsehen die Sammlungen auf loc.gov, wo jede Sammlung die zugehörigen Websites auflistet; einzelne Sammlungs- und Objektseiten lassen sich zudem durch Anhängen eines Abfrageparameters als strukturiertes JSON abrufen. Für das Nachschlagen beliebiger URLs ist das Archiv nicht ausgelegt; seine Stärke ist die über Jahre aufgebaute Tiefe innerhalb sorgfältig definierter Themen.

Was drinsteckt

Das Programm umfasst mehr als 100 kuratierte thematische Sammlungen mit etwa vier Petabyte an Daten – eine Zahl, die sich seit 2019 mit der Ausweitung der Sammelmethoden ungefähr verdoppelt hat.

API-Zugang

loc.gov JSON: append ?fo=json to collection/item URLs.

Zugang

Frei erreichbar – ohne Schlüssel, Anmeldung oder Captcha.

Startseite

https://www.loc.gov/web-archives/

Ähnliche Archive