Archivarix

web-archive

Archive-It (Internet Archive)

Подписной сервис архивации от Internet Archive, которым пользуются более тысячи библиотек, государственных органов и университетов для создания курируемых веб-коллекций, вместе содержащих десятки миллиардов документов. Снимки открываются по ссылкам воспроизведения на wayback.archive-it.org и организованы по коллекциям. Он оправдывает себя, когда коллекция конкретного учреждения покрывает вашу тему; охват формируется коллекция за коллекцией, поэтому искать здесь произвольные URL не стоит.

Веб-страницы и сайты
Искать в этом архиве

Программная проверка недоступна, откроется собственный поиск архива.

Чем полезен и как работает

В Archive-It учреждения — университеты, государственные органы, библиотеки — создают и ведут собственные профильные веб-коллекции, поэтому сервис особенно хорош, когда ваша тема попадает в область комплектования конкретной организации. Более 1000 учреждений-партнёров по всему миру создали свыше 10 000 публичных коллекций, и по всем ним доступен полнотекстовый поиск на archive-it.org. Материалы можно просматривать по организациям или темам, а затем открывать снимки в интерфейсе воспроизведения в стиле Wayback. Поскольку охват формируется коллекция за коллекцией, сервис лучше всего работает, когда вы уже определили подходящую коллекцию, а не когда ищете произвольный URL.

Что внутри

Партнёры совместно заархивировали десятки миллиардов документов. Сервис растёт с 2006 года, а совокупные фонды достигают петабайтного масштаба, хотя отдельная сводная цифра, обособленная от показателей Internet Archive в целом, не публикуется.

Доступ по API

Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.

Доступ

Программный доступ через API (может потребоваться ключ — см. метку API).

Сайт

https://archive-it.org/

Похожие архивы