web-archive
Library of Congress Web Archives
Das kuratierte Web-Archivierungsprogramm der Library of Congress: mehr als hundert thematische Sammlungen von Websites, ausgewählt von ihren Bibliothekaren, im Petabyte-Maßstab. Sie durchsehen die Sammlungen auf loc.gov; Sammlungs- und Objektseiten lassen sich auch als JSON abrufen. Es spielt seine Stärken aus, wenn Ihr Thema zu einem der kuratierten Schwerpunkte passt – Wahlen, Ereignisse, Organisationen – weniger beim Nachschlagen beliebiger URLs.
Warum es nützlich ist & wie es funktioniert
Das Web-Archiv der Library of Congress lohnt sich für Forschende, deren Thema zu einem der kuratierten Schwerpunkte passt: Wahlen, bedeutende Ereignisse, Regierungsprogramme, Kulturorganisationen und ähnliche Gegenstände, ausgewählt von den Bibliothekaren der LoC. Sie durchsehen die Sammlungen auf loc.gov, wo jede Sammlung die zugehörigen Websites auflistet; einzelne Sammlungs- und Objektseiten lassen sich zudem durch Anhängen eines Abfrageparameters als strukturiertes JSON abrufen. Für das Nachschlagen beliebiger URLs ist das Archiv nicht ausgelegt; seine Stärke ist die über Jahre aufgebaute Tiefe innerhalb sorgfältig definierter Themen.
Was drinsteckt
Das Programm umfasst mehr als 100 kuratierte thematische Sammlungen mit etwa vier Petabyte an Daten – eine Zahl, die sich seit 2019 mit der Ausweitung der Sammelmethoden ungefähr verdoppelt hat.
API-Zugang
loc.gov JSON: append ?fo=json to collection/item URLs.
Zugang
Frei erreichbar – ohne Schlüssel, Anmeldung oder Captcha.