Archivarix

web-archive

Trove / Australian Web Archive (NLA)

O arquivo da web da Biblioteca Nacional da Austrália. PANDORA, o Australian Government Web Archive e os rastreamentos do domínio .au reunidos, com bilhões de arquivos e pesquisa pelo portal Trove. As capturas abrem como links de reprodução em webarchive.nla.gov.au; a API do Trove não cobre sites arquivados, portanto a busca acontece no próprio site. A principal fonte para a história dos sites australianos.

Páginas e sites
Pesquisar neste arquivo

Sem verificação programática, abre a própria busca do arquivo.

Por que é útil e como funciona

O Australian Web Archive é o principal registro histórico dos sites australianos, reunindo o antigo arquivo seletivo PANDORA, o Australian Government Web Archive e rastreamentos amplos do domínio .au. A busca e a descoberta de conteúdo australiano arquivado são feitas pelo portal Trove, em trove.nla.gov.au, e as próprias páginas capturadas abrem no visualizador de reprodução da Biblioteca Nacional, em webarchive.nla.gov.au. Como a API de busca do Trove não expõe os registros de sites arquivados, o Echo leva diretamente ao endereço de reprodução de uma determinada URL para que ela possa ser vista ali.

O que há dentro

Em 2019, o acervo combinado somava quase 700 terabytes e mais de 10 bilhões de arquivos, e continuou crescendo. Só o componente curado PANDORA reúne mais de 1,3 bilhão de arquivos em quase 80.000 títulos arquivados.

Acesso via API

Trove API v3 (key) does NOT expose archived-website records. Replay https://webarchive.nla.gov.au/awa/ <ts>/<url>.

É necessária uma chave de API (geralmente gratuita); veja os endpoints acima para saber onde obtê-la.

Acesso

Apenas link do catálogo: abra o arquivo e faça a busca por conta própria.

Página inicial

https://trove.nla.gov.au/

Arquivos relacionados