web-archive
Wayback Machine (Internet Archive)
O principal arquivo de páginas web do Internet Archive e o maior de seu tipo, com mais de um trilhão de capturas de URLs tal como apareceram ao longo do tempo. Informe qualquer endereço web para percorrer seu histórico de instantâneos na interface web; APIs gratuitas também permitem verificar se uma página está arquivada e listar todas as capturas. É a primeira parada padrão quando se precisa de uma versão antiga ou excluída de quase qualquer página web. O serviço teve quedas intermitentes em 2026 e limita o uso intenso, embora as capturas existentes continuem legíveis.
Por que é útil e como funciona
O Wayback Machine é a primeira opção sempre que se precisa de uma versão antiga ou excluída de quase qualquer página pública da web. Ao informar uma URL em web.archive.org, um calendário mostra todas as datas em que um instantâneo foi feito; escolha uma data para navegar pela página como ela estava naquele dia, com os links internos funcionando. O serviço também oferece uma API gratuita e sem chave para verificar se uma URL está arquivada e para listar todas as capturas de um endereço, o que facilita a integração em fluxos de trabalho de pesquisa. Vale notar que alguns veículos jornalísticos restringiram novos rastreamentos, embora isso não afete as capturas já existentes.
O que há dentro
Mais de um trilhão de páginas web capturadas desde 1996, marca atingida em outubro de 2025. O acervo abrange cerca de 99 petabytes de dados únicos, chegando a mais de 212 petabytes com os backups, e cresce centenas de milhões de páginas por dia.
Acesso via API
Availability https://archive.org/wayback/available?url= ; CDX http://web.archive.org/cdx/search/cdx?url=&output=json ; TimeMap http://web.archive.org/web/timemap/link/ ; replay https://web.archive.org/web/ <ts>/<url>
O que medimos
As nossas próprias sondagens, não o que o arquivo afirma. Repetidas periodicamente; cada valor tem data.
Acessibilidade
- Pedido direto
- Respondeu HTTP 200 1,3 s
- Através de um proxy de centro de dados
- Respondeu HTTP 200 4,9 s
- API availability, de forma direta
- Respondeu HTTP 200 787 ms
- API availability, através de proxy
- Respondeu HTTP 200 702 ms
- API CDX, de forma direta
- Tempo esgotado 15 s (This operation was aborted)
- API CDX, através de proxy
- Respondeu HTTP 200 9,1 s
- API timemap, de forma direta
- Respondeu HTTP 200 1,3 s
- API timemap, através de proxy
- Respondeu HTTP 200 3,2 s
Uma pesquisa real devolveu alguma coisa?
Devolveu resultados · 21 resultados para a consulta de teste · mediana 25,8 s · instável entre execuções
Lento: conte com esperas longas ou invoque de forma assíncrona.
CDX is slow (17-25s); use the Availability API for existence checks, CDX only for full capture lists.
Consulta de teste: http://example.com:80/
Cobertura no benchmark
Encontrou 9 de 10 itens de teste (90%) no cluster Páginas e sites. Resposta mediana 9,9 s.
Consoante o quão conhecido é o item: 3/3 muito conhecidos, 3/4 intermédios, 3/3 pouco conhecidos .
Acessibilidade medida a 2026-08-22. Pesquisa verificada em 2026-08-22. Execução do benchmark a 2026-08-22.
Acesso
De acesso livre: sem chave, login ou captcha.