web-archive
Wayback Machine (Internet Archive)
El archivo de páginas web insignia de Internet Archive y el mayor de su clase, con más de un billón de capturas de URL tal como se mostraban en cada momento. Basta con introducir cualquier dirección web para consultar su histórico de instantáneas en la interfaz web; también hay API gratuitas que permiten comprobar si una página está archivada y listar todas sus capturas. Es la primera parada por defecto cuando se necesita una versión antigua o eliminada de casi cualquier página web. El servicio ha sufrido caídas intermitentes en 2026 y limita el uso intensivo, aunque las capturas existentes siguen siendo consultables.
Por qué es útil y cómo funciona
Wayback Machine es el primer recurso al que conviene acudir siempre que se necesite una versión antigua o eliminada de casi cualquier página web pública. Al introducir una URL en web.archive.org, un calendario muestra todas las fechas en las que se tomó una instantánea; al elegir una fecha se navega por la página tal como se veía ese día, con los enlaces internos operativos. Ofrece además una API gratuita y sin clave para comprobar si una URL está archivada y para listar todas las capturas de una dirección, lo que facilita su integración en flujos de trabajo de investigación. Conviene tener en cuenta que algunos editores de prensa han restringido el nuevo rastreo, aunque ello no afecta a las capturas ya existentes.
Qué contiene
Más de un billón de páginas web capturadas desde 1996, un hito alcanzado en octubre de 2025. La colección abarca unos 99 petabytes de datos únicos, que superan los 212 petabytes contando las copias de seguridad, y crece a un ritmo de cientos de millones de páginas al día.
Acceso por API
Availability https://archive.org/wayback/available?url= ; CDX http://web.archive.org/cdx/search/cdx?url=&output=json ; TimeMap http://web.archive.org/web/timemap/link/ ; replay https://web.archive.org/web/ <ts>/<url>
Acceso
De acceso libre: sin clave, sin registro y sin captcha.