web-archive
Archive-It (Internet Archive)
El servicio de archivado por suscripción de Internet Archive, empleado por más de mil bibliotecas, administraciones y universidades para construir colecciones web curadas que en conjunto reúnen decenas de miles de millones de documentos. Las capturas se consultan mediante enlaces de reproducción en wayback.archive-it.org, organizados por colección. Compensa cuando la colección de una institución concreta cubre el tema buscado; la cobertura va colección por colección, así que no es el lugar donde consultar URL arbitrarias.
Sin comprobación programática; abre la propia búsqueda del archivo.
Por qué es útil y cómo funciona
Archive-It es donde instituciones como universidades, organismos públicos y bibliotecas construyen y mantienen sus propias colecciones web temáticas, por lo que resulta idóneo cuando el asunto buscado cae dentro del ámbito de recopilación de una organización concreta. Más de 1.000 instituciones asociadas de todo el mundo han creado más de 10.000 colecciones públicas, todas ellas con búsqueda de texto completo en archive-it.org. Se puede navegar por organización o por tema y consultar después las capturas mediante una interfaz de reproducción al estilo de Wayback. Como la cobertura va colección por colección, funciona mejor cuando ya se ha identificado una colección pertinente que cuando se busca una URL arbitraria.
Qué contiene
En conjunto, las entidades asociadas han archivado decenas de miles de millones de documentos. El servicio crece desde 2006 y sus fondos combinados alcanzan la escala de petabytes, aunque no se publica una cifra agregada independiente de la del conjunto de Internet Archive.
Acceso por API
Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.
Lo que medimos
Nuestras propias pruebas, no lo que afirma el archivo. Se repiten periódicamente; cada dato lleva su fecha.
Accesibilidad
- Petición directa
- Respondió HTTP 200 574 ms
- A través de un proxy de centro de datos
- Respondió HTTP 200 1,1 s
- All CDX, de forma directa
- Bloqueado HTTP 403 325 ms
- All CDX, a través de proxy
- Bloqueado HTTP 403 927 ms
- Collection 2950 CDX, de forma directa
- Respondió HTTP 200 323 ms
- Collection 2950 CDX, a través de proxy
- Respondió HTTP 200 1,1 s
- Collection 2950 replay, de forma directa
- Respondió HTTP 200 828 ms
- Collection 2950 replay, a través de proxy
- Respondió HTTP 200 1,6 s
¿Una búsqueda real devolvió algo?
No concluyente · mediana 840 ms · estable entre ejecuciones
The per-collection CDX endpoint now answers with a "Session Verification" interstitial rather than JSON, so nothing can be counted. Coverage was always collection-specific and empty for arbitrary URLs: treat as link-only unless a collection is known.
Accesibilidad medida el 2026-08-22. Búsqueda comprobada el 2026-08-22.
Acceso
Acceso programático mediante API (puede requerir clave, consulte la etiqueta API).