Archivarix

web-archive

Wayback Machine (Internet Archive)

O principal arquivo de páginas web do Internet Archive e o maior de seu tipo, com mais de um trilhão de capturas de URLs tal como apareceram ao longo do tempo. Informe qualquer endereço web para percorrer seu histórico de instantâneos na interface web; APIs gratuitas também permitem verificar se uma página está arquivada e listar todas as capturas. É a primeira parada padrão quando se precisa de uma versão antiga ou excluída de quase qualquer página web. O serviço teve quedas intermitentes em 2026 e limita o uso intenso, embora as capturas existentes continuem legíveis.

Páginas e sites API degradado

Por que é útil e como funciona

O Wayback Machine é a primeira opção sempre que se precisa de uma versão antiga ou excluída de quase qualquer página pública da web. Ao informar uma URL em web.archive.org, um calendário mostra todas as datas em que um instantâneo foi feito; escolha uma data para navegar pela página como ela estava naquele dia, com os links internos funcionando. O serviço também oferece uma API gratuita e sem chave para verificar se uma URL está arquivada e para listar todas as capturas de um endereço, o que facilita a integração em fluxos de trabalho de pesquisa. Vale notar que alguns veículos jornalísticos restringiram novos rastreamentos, embora isso não afete as capturas já existentes.

O que há dentro

Mais de um trilhão de páginas web capturadas desde 1996, marca atingida em outubro de 2025. O acervo abrange cerca de 99 petabytes de dados únicos, chegando a mais de 212 petabytes com os backups, e cresce centenas de milhões de páginas por dia.

Acesso via API

Availability https://archive.org/wayback/available?url= ; CDX http://web.archive.org/cdx/search/cdx?url=&output=json ; TimeMap http://web.archive.org/web/timemap/link/ ; replay https://web.archive.org/web/ <ts>/<url>

Acesso

De acesso livre: sem chave, login ou captcha.

Página inicial

https://web.archive.org/

Arquivos relacionados