Archivarix

web-archive

Wayback Machine (Internet Archive)

El archivo de páginas web insignia de Internet Archive y el mayor de su clase, con más de un billón de capturas de URL tal como se mostraban en cada momento. Basta con introducir cualquier dirección web para consultar su histórico de instantáneas en la interfaz web; también hay API gratuitas que permiten comprobar si una página está archivada y listar todas sus capturas. Es la primera parada por defecto cuando se necesita una versión antigua o eliminada de casi cualquier página web. El servicio ha sufrido caídas intermitentes en 2026 y limita el uso intensivo, aunque las capturas existentes siguen siendo consultables.

Páginas y sitios web API degradado

Por qué es útil y cómo funciona

Wayback Machine es el primer recurso al que conviene acudir siempre que se necesite una versión antigua o eliminada de casi cualquier página web pública. Al introducir una URL en web.archive.org, un calendario muestra todas las fechas en las que se tomó una instantánea; al elegir una fecha se navega por la página tal como se veía ese día, con los enlaces internos operativos. Ofrece además una API gratuita y sin clave para comprobar si una URL está archivada y para listar todas las capturas de una dirección, lo que facilita su integración en flujos de trabajo de investigación. Conviene tener en cuenta que algunos editores de prensa han restringido el nuevo rastreo, aunque ello no afecta a las capturas ya existentes.

Qué contiene

Más de un billón de páginas web capturadas desde 1996, un hito alcanzado en octubre de 2025. La colección abarca unos 99 petabytes de datos únicos, que superan los 212 petabytes contando las copias de seguridad, y crece a un ritmo de cientos de millones de páginas al día.

Acceso por API

Availability https://archive.org/wayback/available?url= ; CDX http://web.archive.org/cdx/search/cdx?url=&output=json ; TimeMap http://web.archive.org/web/timemap/link/ ; replay https://web.archive.org/web/ <ts>/<url>

Lo que medimos

Nuestras propias pruebas, no lo que afirma el archivo. Se repiten periódicamente; cada dato lleva su fecha.

Accesibilidad

Petición directa
Respondió HTTP 200 1,3 s
A través de un proxy de centro de datos
Respondió HTTP 200 4,9 s
API availability, de forma directa
Respondió HTTP 200 787 ms
API availability, a través de proxy
Respondió HTTP 200 702 ms
API CDX, de forma directa
Tiempo agotado 15 s (This operation was aborted)
API CDX, a través de proxy
Respondió HTTP 200 9,1 s
API timemap, de forma directa
Respondió HTTP 200 1,3 s
API timemap, a través de proxy
Respondió HTTP 200 3,2 s

¿Una búsqueda real devolvió algo?

Devolvió resultados · 21 resultados para la consulta de prueba · mediana 25,8 s · inestable entre ejecuciones

Lento: prevé esperas largas o llámalo de forma asíncrona.

CDX is slow (17-25s); use the Availability API for existence checks, CDX only for full capture lists.

Consulta de prueba: http://example.com:80/

Cobertura en el banco de pruebas

Encontró 9 de 10 elementos de prueba (90%) en el clúster Páginas y sitios web. Respuesta mediana 9,9 s.

Según lo conocido que sea el elemento: 3/3 muy conocidos, 3/4 intermedios, 3/3 poco conocidos .

Accesibilidad medida el 2026-08-22. Búsqueda comprobada el 2026-08-22. Banco de pruebas ejecutado el 2026-08-22.

Acceso

De acceso libre: sin clave, sin registro y sin captcha.

Página principal

https://web.archive.org/

Archivos relacionados