Aller au contenu
Appvizer
archive.today logo

archive.today : Capture instantanée de pages web

archive.today : en résumé

archive.today (anciennement archive.is) est un service d’archivage web à la demande lancé en 2012. Il permet de capturer une page web complète à un instant donné, en contournant les restrictions courantes telles que les fichiers robots.txt ou certains paywalls. Le service est destiné à un public professionnel comme les journalistes, chercheurs, juristes ou documentalistes, ainsi qu’aux utilisateurs soucieux de préserver des pages avant modification ou suppression.

Ses principaux avantages résident dans sa capacité à :

  • générer des archives complètes de pages dynamiques (JavaScript, AJAX),
  • conserver les pages même lorsque la source devient inaccessible,
  • contourner des blocages d’indexation,
  • fournir une preuve immuable, horodatée et consultable sans dépendre de la source d’origine.

Quelles sont les principales fonctionnalités d’archive.today ?

Capture instantanée sur demande

archive.today permet de capturer en temps réel une page web, en sauvegardant à la fois :

  • une version HTML entièrement navigable avec tous les liens internes,
  • une image statique haute fidélité de la page telle qu’affichée au moment de la capture.

Cette double archive garantit la persistance du contenu même en cas de suppression ou de modification ultérieure.

Contournement des restrictions robots.txt et des paywalls

archive.today n’applique pas les directives de fichiers robots.txt, ce qui le distingue de services comme la Wayback Machine. Il peut ainsi archiver des contenus qui bloquent l’indexation standard, y compris des articles sous paywall léger ou soft paywall. Cela permet de préserver des pages souvent inaccessibles à d’autres outils d’archivage.

Moteur de recherche avancé

Un moteur intégré permet de rechercher des archives selon :

  • l’URL exacte,
  • un domaine complet,
  • des mots-clés,
  • ou l’utilisation de caractères génériques (wildcards).

Si la recherche ne retourne aucun résultat via Google, le système bascule automatiquement vers Yandex, moteur plus permissif dans l’indexation d’archives.

Formats pris en charge et limites techniques

archive.today enregistre uniquement le contenu HTML, CSS, JS et images affichés au moment de la capture. Il ne prend pas en charge :

  • les fichiers vidéo ou audio intégrés,
  • les PDF, fichiers Flash, ou documents binaires externes.

La taille maximale d’une page à capturer est limitée à environ 50 Mo de contenu.

Export ZIP et compatibilité avec Memento

Les archives plus anciennes peuvent être téléchargées en ZIP pour un archivage local. Le service est compatible avec le protocole Memento, facilitant l’interopérabilité avec d’autres services d’archivage.

Extensions et intégrations

Des extensions de navigateur existent pour Chrome, Firefox et Edge. Elles permettent :

  • d’archiver une page d’un clic,
  • d’accéder rapidement à la version archivée d’un lien.

Des bookmarklets et outils Android comme Share2Archive permettent aussi d’automatiser l’archivage depuis un appareil mobile.

Pourquoi choisir archive.today ?

  • Archivage immédiat et public : aucune file d’attente, accessible dès la capture.
  • Aucune dépendance aux politiques d’exclusion : robots.txt ignoré, contenus souvent inaccessibles capturés.
  • Précision visuelle et technique : pages rendues fidèlement, même avec scripts lourds ou DOM complexes.
  • Recherche multicanal efficace : moteur propre avec relais vers Yandex en cas d’échec.
  • Utilisation pratique : extensions, bookmarklets et export local.

archive.today : Ses tarifs

Standard

Tarif

sur demande