web-archive
Archive-It (Internet Archive)
El servicio de archivado por suscripción de Internet Archive, empleado por más de mil bibliotecas, administraciones y universidades para construir colecciones web curadas que en conjunto reúnen decenas de miles de millones de documentos. Las capturas se consultan mediante enlaces de reproducción en wayback.archive-it.org, organizados por colección. Compensa cuando la colección de una institución concreta cubre el tema buscado; la cobertura va colección por colección, así que no es el lugar donde consultar URL arbitrarias.
Sin comprobación programática; abre la propia búsqueda del archivo.
Por qué es útil y cómo funciona
Archive-It es donde instituciones como universidades, organismos públicos y bibliotecas construyen y mantienen sus propias colecciones web temáticas, por lo que resulta idóneo cuando el asunto buscado cae dentro del ámbito de recopilación de una organización concreta. Más de 1.000 instituciones asociadas de todo el mundo han creado más de 10.000 colecciones públicas, todas ellas con búsqueda de texto completo en archive-it.org. Se puede navegar por organización o por tema y consultar después las capturas mediante una interfaz de reproducción al estilo de Wayback. Como la cobertura va colección por colección, funciona mejor cuando ya se ha identificado una colección pertinente que cuando se busca una URL arbitraria.
Qué contiene
En conjunto, las entidades asociadas han archivado decenas de miles de millones de documentos. El servicio crece desde 2006 y sus fondos combinados alcanzan la escala de petabytes, aunque no se publica una cifra agregada independiente de la del conjunto de Internet Archive.
Acceso por API
Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.
Acceso
Acceso programático mediante API (puede requerir clave, consulte la etiqueta API).