Archivarix

web-archive

Archive-It (Internet Archive)

El servicio de archivado por suscripción de Internet Archive, empleado por más de mil bibliotecas, administraciones y universidades para construir colecciones web curadas que en conjunto reúnen decenas de miles de millones de documentos. Las capturas se consultan mediante enlaces de reproducción en wayback.archive-it.org, organizados por colección. Compensa cuando la colección de una institución concreta cubre el tema buscado; la cobertura va colección por colección, así que no es el lugar donde consultar URL arbitrarias.

Páginas y sitios web
Buscar en este archivo

Sin comprobación programática; abre la propia búsqueda del archivo.

Por qué es útil y cómo funciona

Archive-It es donde instituciones como universidades, organismos públicos y bibliotecas construyen y mantienen sus propias colecciones web temáticas, por lo que resulta idóneo cuando el asunto buscado cae dentro del ámbito de recopilación de una organización concreta. Más de 1.000 instituciones asociadas de todo el mundo han creado más de 10.000 colecciones públicas, todas ellas con búsqueda de texto completo en archive-it.org. Se puede navegar por organización o por tema y consultar después las capturas mediante una interfaz de reproducción al estilo de Wayback. Como la cobertura va colección por colección, funciona mejor cuando ya se ha identificado una colección pertinente que cuando se busca una URL arbitraria.

Qué contiene

En conjunto, las entidades asociadas han archivado decenas de miles de millones de documentos. El servicio crece desde 2006 y sus fondos combinados alcanzan la escala de petabytes, aunque no se publica una cifra agregada independiente de la del conjunto de Internet Archive.

Acceso por API

Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.

Lo que medimos

Nuestras propias pruebas, no lo que afirma el archivo. Se repiten periódicamente; cada dato lleva su fecha.

Accesibilidad

Petición directa
Respondió HTTP 200 574 ms
A través de un proxy de centro de datos
Respondió HTTP 200 1,1 s
All CDX, de forma directa
Bloqueado HTTP 403 325 ms
All CDX, a través de proxy
Bloqueado HTTP 403 927 ms
Collection 2950 CDX, de forma directa
Respondió HTTP 200 323 ms
Collection 2950 CDX, a través de proxy
Respondió HTTP 200 1,1 s
Collection 2950 replay, de forma directa
Respondió HTTP 200 828 ms
Collection 2950 replay, a través de proxy
Respondió HTTP 200 1,6 s

¿Una búsqueda real devolvió algo?

No concluyente · mediana 840 ms · estable entre ejecuciones

The per-collection CDX endpoint now answers with a "Session Verification" interstitial rather than JSON, so nothing can be counted. Coverage was always collection-specific and empty for arbitrary URLs: treat as link-only unless a collection is known.

Accesibilidad medida el 2026-08-22. Búsqueda comprobada el 2026-08-22.

Acceso

Acceso programático mediante API (puede requerir clave, consulte la etiqueta API).

Página principal

https://archive-it.org/

Archivos relacionados