web-archive
Archive-It (Internet Archive)
Le service d'archivage sur abonnement d'Internet Archive, utilisé par plus d'un millier de bibliothèques, d'administrations et d'universités pour constituer des collections web éditorialisées qui réunissent ensemble des dizaines de milliards de documents. Les captures se consultent via des liens de relecture sur wayback.archive-it.org, organisés par collection. Il s'avère payant lorsque la collection d'une institution précise couvre votre sujet ; la couverture s'organisant collection par collection, ce n'est pas l'endroit où rechercher une URL quelconque.
Pas de vérification automatique, ouvre la recherche propre à l’archive.
Son utilité et son fonctionnement
Archive-It est l'endroit où des institutions telles que des universités, des organismes publics et des bibliothèques constituent et entretiennent leurs propres collections web ciblées : le service excelle donc lorsque votre sujet relève du domaine de collecte d'une organisation précise. Plus de 1 000 institutions partenaires dans le monde ont créé plus de 10 000 collections publiques, toutes interrogeables en texte intégral sur archive-it.org. Vous pouvez parcourir les collections par organisation ou par thème, puis consulter les captures dans une interface de relecture de type Wayback. La couverture s'organisant collection par collection, l'outil donne les meilleurs résultats lorsque vous avez identifié une collection pertinente plutôt que lorsque vous cherchez une URL quelconque.
Ce qu’elle contient
Les partenaires ont collectivement archivé des dizaines de milliards de documents. Le service se développe depuis 2006 et les fonds réunis atteignent l'échelle du pétaoctet, même si aucun chiffre global n'est publié séparément de celui d'Internet Archive.
Accès API
Per-collection CDX https://wayback.archive-it.org/ <collId>/timemap/cdx?url= (works) ; replay https://wayback.archive-it.org/ <collId>/<ts>/<url> . Aggregate /all/ CDX is blocked.
Ce que nous avons mesuré
Nos propres sondes, pas les promesses de l’archive. Relancées régulièrement ; chaque valeur est datée.
Accessibilité
- Requête directe
- A répondu HTTP 200 574 ms
- Via un proxy de centre de données
- A répondu HTTP 200 1,1 s
- All CDX, en direct
- Bloqué HTTP 403 325 ms
- All CDX, via un proxy
- Bloqué HTTP 403 927 ms
- Collection 2950 CDX, en direct
- A répondu HTTP 200 323 ms
- Collection 2950 CDX, via un proxy
- A répondu HTTP 200 1,1 s
- Collection 2950 replay, en direct
- A répondu HTTP 200 828 ms
- Collection 2950 replay, via un proxy
- A répondu HTTP 200 1,6 s
Une vraie recherche a-t-elle renvoyé quelque chose ?
Non concluant · médiane 840 ms · stable d’une exécution à l’autre
The per-collection CDX endpoint now answers with a "Session Verification" interstitial rather than JSON, so nothing can be counted. Coverage was always collection-specific and empty for arbitrary URLs: treat as link-only unless a collection is known.
Accessibilité mesurée le 2026-08-22. Recherche vérifiée le 2026-08-22.
Accès
Accès programmatique via une API (une clé peut être requise, voir l’étiquette API).