ArchiveBoxArchives web

Archivage Web auto-hébergé open source

Préservez le Web.Sur l'infrastructure que vous contrôlez.

ArchiveBox enregistre les sites Web, les signets, les flux RSS, les publications sociales, les médias, le code source et le matériel de recherche dans des fichiers durables tels que HTML, PDF, PNG, TXT, JSON, WARC, MP4 et SQLite.

Voir les captures d'écran ↗   ·   Voir la démo ↗




Insigne MIT open source Insigne de développement actif Insigne étoiles GitHub Docker tire le badge PyPI installe le badge Badge d'utilisateur du Chrome Store
# Docker Compose est la configuration recommandée
$ mkdir -p ~/archivebox/data && cd ~/archivebox
$ curl -fsSL 'https://docker-compose.archivebox.io' > docker-compose.yml
$ docker compose -d --wait
-> initialisé ./data/index.sqlite3
ok, j'écoute sur http://127.0.0.1:5797
$ 
Interface utilisateur Web d'ArchiveBox affichant les pages enregistrées avec des vignettes et des formats de capture ArchiveBox sur iPhone, avec sa collection, ses balises et sa connexion au serveur dans un cadre iPhone

Parcourez et enregistrez depuis n’importe quel appareil.
Gratuit, auto-hébergé, 0 analyse.

Snapshots grid — desktopSnapshot View (header collapsed) — desktopAI agent — desktopArchive results — desktopAdd URLs — desktopSnapshots table — desktopLogin — desktopPublic snapshot list — desktopSnapshot View (capture in progress) — desktopAdmin dashboard — desktopSnapshot admin detail — desktopSnapshot files — desktopArchive result detail — desktopTags — desktopTag detail — desktopUsers — desktopUser detail — desktopCrawls — desktopCrawl detail — desktopCrawl schedules — desktopCrawl schedule detail — desktopPersonas — desktopPersona detail — desktopMachines — desktopMachine detail — desktopNetwork interfaces — desktopNetwork interface detail — desktopBinaries — desktopBinary detail — desktopProcesses — desktopProcess detail — desktopAPI tokens — desktopAPI token detail — desktopWebhooks — desktopWebhook detail — desktopEnvironment — desktopConfiguration — desktopConfiguration detail — desktopDependencies — desktopDependency detail — desktopPlugins — desktopWorkers — desktopWorker detail — desktopLogs — desktopLog detail — desktopSnapshot View (singlefile) — desktopSnapshot View (screenshot) — desktopSnapshot View (wget) — desktopSnapshot View (dom) — desktopSnapshot View (pdf) — desktopSnapshot View (readability) — desktopSnapshot View (ytdlp) — desktopSnapshot View (responses) — desktopSnapshot View (chrome_mhtml) — desktopSnapshot View (defuddle) — desktopSnapshot View (mercury) — desktopSnapshot View (archivewebpage) — desktopSnapshot View (chrome) — desktopSnapshot View (consolelog) — desktopSnapshot View (dns) — desktopSnapshot View (sslcerts) — desktopSnapshot View (redirects) — desktopSnapshot View (headers) — desktopSnapshot View (seo) — desktopSnapshot View (accessibility) — desktopSnapshot View (htmltotext) — desktopSnapshot View (trafilatura) — desktopSnapshot View (liteparse) — desktopSnapshot View (parse_html_urls) — desktopSnapshot View (parse_txt_urls) — desktopSnapshot View (parse_dom_outlinks) — desktopSnapshot View (hashes) — desktopArchiveBox snapshot detail with a verified TLSNotary receipt and archived response
CLI Interface utilisateur Web REST API Webhooks Extension de navigateur Accès au système de fichiers

Pourquoi ArchiveBox

Conçu pour rendre vos données archivées utiles aujourd'hui.

Enregistre les onglets en quelques secondes, les stocke pendant des décennies

Collectez des signets pour les lire plus tard ou conservez des preuves pour des affaires juridiques avec des captures vérifiables de notre Plugin de signature TLSNotary.

Marquez et recherchez instantanément des millions de captures

Organisez votre collection avec des balises et trouvez ce dont vous avez besoin grâce à la recherche en texte intégral optimisée par Sonic et Ripgrep.

Extraction automatique des médias intégrés vers des formats standard

Extrayez automatiquement l'audio, la vidéo, les archives git, les messages du forum, les métadonnées SEO, etc. fichiers ordinaires vous pouvez ouvrir et réutiliser.

Connectez-vous facilement à d’autres systèmes

Dites à votre IA d'inspecter une page avec abx-dl, extrayez un flux RSS toutes les 24 heures ou orchestrez des analyses complexes MCP et le REST API.

Pour qui c'est

Des fonctionnalités puissantes pour les particuliers, les professionnels et les institutions.

Archivistes personnels et auto-hébergeurs

Enregistrez les favoris, l'historique du navigateur, les flux RSS, les réseaux sociaux, le contenu des formulaires, les vidéos, les podcasts, la musique, les photos et les collections de connaissances personnelles.

  • Possédez vos données et conservez-les sur un stockage local ou distant que vous contrôlez.
  • Utilisez ensemble l’extension de navigateur, la CLI, l’interface utilisateur Web et les importations planifiées.
  • Exportez du HTML statique ou parcourez directement le système de fichiers.
Feuille de partage iPhone confirmant qu'une URL a été enregistrée avec des balises Feuille de partage Android affichant une sauvegarde réussie, des balises suggérées et la confirmation que les balises ont été enregistrées

Avocats et journalistes

Conservez des copies des articles, des sources et des archives publiques, même après la modification ou la disparition des pages originales.

  • Stockez des captures d'écran, des PDF, des en-têtes, des fichiers WARC et des extractions de texte.
  • Marquez et examinez les sources via l’interface Web auto-hébergée.
  • Utilisez des preuves ZK avec TLSNotaire pour prouver l'authenticité du contenu.
Sortie TLSNotary vérifiant une réponse archivée sur la page de détails de l'instantané

Chercheurs et institutions

Soutenez OSINT, la recherche sur les réseaux sociaux, les agents de recherche basés sur l'IA, les bibliothèques, les gouvernements et les équipes de constitution de collections.

  • Automatisez les importations via la CLI, l'API REST, les webhooks et les planifications.
  • Conservez les métadonnées lisibles par machine dans JSON et SQLite.
  • Étendez les pipelines d’extraction via l’écosystème ArchiveBox.
Options de profondeur d'archivage, de portée du domaine et du sous-chemin, de liste d'autorisation d'URL et de liste de refus d'URL sur la page Ajouter

Obtenir ArchiveBox

Démarrage rapide

Choisissez comment vous souhaitez exécuter vos archives. Docker Compose est recommandé pour la plupart des installations.

ArchiveBox — Démarrage rapide
ArchiveBox sur iPhone montrant ses outils de collecte et de serveur
ArchiveBox pour iPhone et iPad
1

Installer ArchiveBox pour iOS

Obtenez ArchiveBox.app pour iOS

Ouvrez le lien TestFlight sur votre iPhone ou iPad pour installer ArchiveBox.

2

Connectez votre serveur

Le guide de première exécution vous aide à choisir un serveur ou à sélectionner J'ai déjà un serveur. Scannez le code QR de connexion depuis ArchiveBox Server.app sur votre Mac, ou saisissez l'URL de votre serveur et la clé API.

3

Enregistrez votre premier lien

Dans Safari ou une autre application, choisissez Partager → ArchiveBox. Votre serveur enregistre la page afin que vous puissiez la parcourir depuis votre téléphone.

Guide de configuration iOS ↗

ArchiveBox sur Android affichant son écran d'accueil, son serveur connecté et ses outils de collecte
ArchiveBox pour Android
1

Installer ArchiveBox pour Android

Obtenez ArchiveBox pour Android

Les APK bêta d’Android apparaîtront ici une fois publiés. Ouvrez l'APK et autorisez l'installation depuis votre navigateur si Android vous le demande.

2

Connectez votre serveur

Utilisez le guide de première exécution pour choisir un serveur ou sélectionnez J'ai déjà un serveur. Dans Paramètres de connexion, saisissez l'URL de votre serveur et la clé API, puis vérifiez la connexion.

3

Enregistrez votre premier lien

Choisir Partager → ArchiveBox depuis votre navigateur ou une autre application, ajoutez des balises et enregistrez. Gardez votre serveur accessible pour enregistrer et parcourir les pages.

Guide de configuration Android ↗

ArchiveBox.app
Applications
Paramètres de connexion ArchiveBox.app avec un serveur local vérifié
macOS 26+ · Apple Silicon
1

Téléchargez et ouvrez l'application

Obtenez ArchiveBox.app pour macOS

Déplacez-le vers Applications et ouvrez-le.

2

Suivez le guide de configuration

Choisir Configurer sur ce Mac dans le guide de configuration, puis téléchargez et ouvrez ArchiveBox Server.app. Vous avez déjà un serveur ? Connectez-vous avec son URL et sa clé API.

3

Connectez vos applications

Utilisez le Interface utilisateur Web, REST API, ou CLI. Connectez le application mobile, extension de navigateur, et d'autres clients utilisant l'URL de votre serveur et la clé API.

Windows
ArchiveBox
Bureau ArchiveBox pour Windows
1

Installer le bureau Docker

Télécharger Docker Bureau et démarrez-le sur votre ordinateur. Laissez Docker fonctionner pendant que vous utilisez ArchiveBox.

2

Télécharger ArchiveBox pour Windows

Ouvrez le programme d'installation, lancez ArchiveBox et créez votre compte administrateur. Le premier lancement prépare votre collection locale.

3

Commencez à économiser

Ajoutez une URL dans l'application pour archiver votre première page.

Guide des applications de bureau ↗

Docker Desktop
ArchiveBox Desktop sous Linux affichant sa collection de pages enregistrées, capturées à partir de l'application packagée dans CI
ArchiveBox Desktop · Véritable application Linux
1

Installer le bureau Docker

Télécharger Docker Bureau et démarrez-le sur votre ordinateur. Laissez Docker fonctionner pendant que vous utilisez ArchiveBox.

2

Télécharger ArchiveBox pour Linux

Ouvrez le programme d'installation, lancez ArchiveBox et créez votre compte administrateur. Le premier lancement prépare votre collection locale.

3

Commencez à économiser

Ajoutez une URL dans l'application pour archiver votre première page.

Guide des applications de bureau ↗

Docker Compose
ArchiveBox
Interface Web d'ArchiveBoxdocker-compose.yml
Recommandé
1

Docker Compose Recommandé

Compose conserve vos paramètres dans un seul fichier et facilite les mises à jour. Installer Docker, puis créez un répertoire et récupérez le fichier config.

mkdir -p ~/archivebox/data && cd ~/archivebox
curl -fsSL 'https://docker-compose.archivebox.io' > docker-compose.yml
2

Démarrer ArchiveBox

docker compose pull
docker compose up -d --wait

Une nouvelle collection s'initialise automatiquement.

3

Terminez la configuration et archivez votre première page

Ouvrir l'interface utilisateur d'administration pour créer votre premier compte administrateur et terminer l'assistant de configuration. Sur un serveur distant, ouvrez /admin/ sur son nom d'hôte ou son IP à la place.

docker compose exec archivebox archivebox add 'https://example.com'
Utilisez plutôt Docker brut docker run

Vous avez un fichier Compose ? Convertissez-le en docker run commandes avec Decomposerize.

1

Créez une collection et démarrez le serveur

Installer Docker d'abord.

mkdir -p ~/archivebox/data && cd ~/archivebox/data
docker run -d --name archivebox -v "$PWD:/data" -p 5797:5797 archivebox/archivebox:dev
2

Terminer la configuration

Ouvrir l'interface utilisateur d'administration pour créer votre premier compte administrateur et terminer l'assistant de configuration. Sur un serveur distant, ouvrez /admin/ sur son nom d'hôte ou son IP à la place.

3

Archivez votre première page

docker exec archivebox archivebox add 'https://example.com'
pip / uv
ArchiveBox
HTMLPDFPNGWARC
Paquet Python
1

Installez le package Python

Installer UV d'abord.

uv tool install --python 3.13 --prerelease explicit --upgrade 'archivebox>=0.9.0rc0,<0.10'
archivebox version
2

Créez une collection et démarrez le serveur

mkdir -p ~/archivebox/data && cd ~/archivebox/data
archivebox init
archivebox install
archivebox server 0.0.0.0:5797
3

Terminer la configuration

Ouvrir l'interface utilisateur d'administration pour créer votre premier compte administrateur et terminer l'assistant de configuration. Sur un serveur distant, ouvrez /admin/ sur son nom d'hôte ou son IP à la place.

Ou utilisez pip au lieu de uv
1

Installer avec pip

Une fois Python 3.13 installé, créez un environnement virtuel et installez ArchiveBox :

python3.13 -m venv ~/.venvs/archivebox
source ~/.venvs/archivebox/bin/activate
python -m pip install --upgrade 'archivebox>=0.9.0rc0,<0.10'
archivebox version

Suivez ensuite les étapes 2 et 3 ci-dessus. Dans chaque nouveau terminal, exécutez source ~/.venvs/archivebox/bin/activate avant d'utiliser archivebox.

apt
ArchiveBox
HTMLPDFPNGWARC
Ubuntu / Debian
1

Ajoutez le référentiel et installez

echo 'deb [trusted=yes] https://archivebox.github.io/debian-archivebox dev main' | sudo tee /etc/apt/sources.list.d/archivebox.list
sudo apt update
sudo apt install archivebox
(cd /tmp && archivebox version)
2

Créez une collection et démarrez le serveur

mkdir -p ~/archivebox/data && cd ~/archivebox/data
archivebox init
sudo archivebox install
archivebox server 0.0.0.0:5797
3

Terminer la configuration

Ouvrir l'interface utilisateur d'administration pour créer votre premier compte administrateur et terminer l'assistant de configuration. Sur un serveur distant, ouvrez /admin/ sur son nom d'hôte ou son IP à la place.

Homebrew
ArchiveBox
HTMLPDFPNGWARC
macOS / Linux
1

Installer à partir du robinet ArchiveBox

Installer Homebrew d'abord. Exécutez ces commandes en tant qu'utilisateur normal, sans sudo.

brew tap archivebox/archivebox
brew trust archivebox/archivebox
brew install archivebox
archivebox version
2

Créez une collection et démarrez le serveur

mkdir -p ~/archivebox/data && cd ~/archivebox/data
archivebox init
archivebox install
archivebox server 0.0.0.0:5797
3

Terminer la configuration

Ouvrir l'interface utilisateur d'administration pour créer votre premier compte administrateur et terminer l'assistant de configuration. Sur un serveur distant, ouvrez /admin/ sur son nom d'hôte ou son IP à la place.

Arch Linux
FreeBSD
Rien
ArchiveBox
Forfaits communautaires
1

Choisissez votre plateforme

Les packages communautaires peuvent être en retard par rapport aux versions Docker et Python.

Arch Linux (AUR)

yay -S archivebox

FreeBSD (raccourci uv)

curl -fsSL 'https://get.archivebox.io' | bash

Rien

nix-env --install archivebox

Guix

guix install archivebox
2

Configurez votre collection

Suivez les instructions de configuration de votre package, puis utilisez le Guide d'utilisation de l'interface CLI pour initialiser et gérer vos archives.

$curl get.archivebox.io
| sh
ArchiveBox
Une commande pour commencer
1

Exécutez le script d'installation

curl -fsSL 'https://get.archivebox.io' | bash

Tu peux lire le scénario avant de l'exécuter.

2

Suivez les invites et terminez la configuration

Suivez les instructions du programme d’installation pour commencer à utiliser votre collection.

Ouvrir l'interface utilisateur d'administration pour créer votre premier compte administrateur et terminer l'assistant de configuration. Sur un serveur distant, ouvrez /admin/ sur son nom d'hôte ou son IP à la place.

ArchiveBox
NASServeur domestique
Sur votre propre matériel
1

Choisissez votre plateforme

Les intégrations communautaires peuvent être en retard par rapport aux versions Docker et Python.

2

Installer et ouvrir ArchiveBox

Suivez le guide d'installation de la plateforme, configurez le stockage persistant, puis ouvrez l'application pour terminer la configuration.

Pour TrueNAS, consultez le Notes de la plateforme README avant de choisir une intégration.

ArchiveBox
Votre serveurN'importe où
Hébergement cloud / VPS
1

Choisissez un fournisseur

Vérifiez les forfaits actuels du fournisseur, les versions prises en charge et les options de stockage.

2

Déployer et terminer la configuration

Utilisez le flux de déploiement ArchiveBox du fournisseur, puis ouvrez votre instance pour créer un compte administrateur. Pour un VPS non géré, suivez le démarrage rapide de Docker Compose sur votre serveur.

URL enregistrées de l'extension de navigateur ArchiveBox
Enregistrez depuis votre navigateur
Chrome · Firefox · Edge · Safari
1

Installer l'extension du navigateur

2

Connectez votre serveur ArchiveBox

Ouvrez la page de configuration de l'extension, saisissez l'URL de votre serveur et la clé API, puis testez la connexion. Utilisez l'un des onglets d'installation du serveur si vous n'avez pas encore de serveur.

3

Enregistrer une page

Ouvrez une page, cliquez sur l'extension ArchiveBox et ajoutez vos balises. Vous pouvez également importer des favoris et un historique à partir des options de l’extension.

Guide d'extension ↗

Configuration

Plus de 50 plugins et options de configuration flexibles.

Parcourir les plugins et les extracteurs ↗

ArchiveBox peut être configuré via l'interface utilisateur d'administration, la CLI, ArchiveBox.conf, ou en important la configuration et les cookies depuis Chrome/d'autres navigateurs. Le même modèle de configuration fonctionne dans Docker, Docker Compose, les installations nues, les tâches planifiées et les exécutions CLI ponctuelles.

Ajuster la façon dont les pages sont capturées

Utiliser TIMEOUT pour les réseaux lents, CHECK_SSL_VALIDITY pour les sites avec des certificats cassés, PUBLIC_INDEX, PUBLIC_SNAPSHOTS, et PUBLIC_ADD_VIEW pour la politique de publication et les paramètres de l'agent utilisateur du navigateur pour les sites qui bloquent les robots évidents.

archivebox config
$ configuration de la boîte d'archives                         # voir la configuration complète
$ configuration de la boîte d'archives --get CHROME_BINARY
$ configuration de la boîte d'archives --set TIMEOUT=240
$ configuration de la boîte d'archives --set PUBLIC_INDEX=False
$ env CHROME_BINARY=chromium archivebox ajouter 'https://example.com'

Dépendances et extracteurs

ArchiveBox utilise des outils standard tels que Chrome ou Chromium, wget, curl, yt-dlp, git, SingleFile, Readability et des analyseurs d'articles. Docker regroupe ces dépendances pour des mises à niveau plus faciles et une meilleure isolation ; les installations non-Docker peuvent s'exécuter archivebox install et archivebox --version pour vérifier ce qui est disponible.

Entrées et sorties

Intégrez les outils que vous utilisez déjà.

Ajouter des URL à ArchiveBox

Importez des URL de n'importe où

Archive une URL à la fois ou planifier les importations depuis signets, historique du navigateur, RSS, JSON, CSV, TXT, SQL, HTML, Markdown, Pocket, Pinboard, Instapaper, Shaarli, Wallabag, et plus.

Enregistrez les liens avec notre extension de navigateur, ou utiliser Menus de partage Mac et iPhone, Siri et raccourcis.

Capturez les changements au fil du temps

Importations d'archives planifiées

Importez de nouvelles URL et capturez des instantanés selon un calendrier, puis comparez les instantanés pour voir comment les sites ont changé.

Page enregistrée avec plusieurs formats de capture

Sorties

Capturez chaque page dans plusieurs formats réutilisables :

Parcourir une archive dans l'interface utilisateur Web

Accéder

Utilisez la même collection partout où vous travaillez :

Disposition du disque, exportation et sécurité

Parcourez vos captures sous forme de fichiers normaux sans avoir besoin d'ArchiveBox.

Vos captures sont du HTML ordinaire, des images, des PDF et des fichiers multimédias. Ouvrez-les depuis le Finder, recherchez-les avec n'importe quel outil de recherche de système de fichiers, laissez les agents IA les parcourir directement et sauvegardez-les sous forme de fichiers normaux.

Conçu pour durer plus de 100 ans

Chaque instantané possède un dossier pour chaque méthode de capture. Le HTML réside dans des dossiers tels que dom/ et singlefile/; les images, les PDF et les médias ont également leurs propres dossiers.

Les métadonnées sont stockées dans SQLite et JSON, avec des métadonnées d'instantané à côté des sorties. La base de données et la configuration de votre collection se trouvent en dehors des dossiers d'instantanés, et vos fichiers restent lisibles sans service hébergé.

macOS Finder avec les dossiers date, news.ycombinator.com et instantanés étendus jusqu'à dom/output.html, avec le fichier HTML enregistré sélectionné

Exportations et publication statiques

Vous pouvez exporter l'index d'archive au format HTML statique, JSON ou CSV avec archivebox list afin que les collections puissent être examinées sans exécuter le serveur Web. Conserver les exportations générées à côté du archive/ afin que les chemins relatifs des instantanés continuent de fonctionner.

$ liste des boîtes d'archives --html --with-headers > index.html
$ liste des boîtes d'archives --json --with-headers > index.json
$ liste des boîtes d'archives --csv=horodatage,url,titre > index.csv
Page archivée rendue à partir du code HTML enregistré

JavaScript archivé

ArchiveBox utilise un Navigateur Chrome pendant l'archivage pour exécuter JavaScript et capturer la page rendue.

ArchiveWeb.page enregistre les pages à relire, y compris leurs scripts et les réponses du réseau. Rejouez les pages capturées avec JavaScript en utilisant ReplayWeb.page, la visionneuse d'archives de Webrecorder.

Détails de l'instantané et taille de l'archive enregistrée

Exigences de stockage

ArchiveBox peut utiliser environ 1 Go à 50 Go pour 1 000 instantanés en fonction des paramètres multimédia, vidéo, audio et de l'extracteur. Régler YTDLP_ENABLED et YTDLP_MAX_SIZE pour les collections à forte intensité médiatique.

Garder index.sqlite3 sur le stockage local ou SSD lorsque cela est possible. Grand archive/ les dossiers peuvent vivre NFS, SMB, FUSE, Soutenu par S3, ou Stockage sur disque dur, mais les configurations Docker et de partage de fichiers peuvent avoir besoin ajustements de propriété et de courge-racine. Évitez les systèmes de fichiers plus anciens comme EXT3 ou FAT pour les très grandes archives.

Planifier de grandes archives

Contexte et motivation

Conservez une copie du site Web qui vous intéresse.

ArchiveBox existe parce que la pourriture des liens, le désabonnement des plateformes, la censure et la disparition des médias effacent régulièrement les connaissances utiles. Le projet vise à rendre le contenu Web qui vous intéresse visible avec des logiciels courants dans 50 à 100 ans, sans nécessiter ArchiveBox ou un service de relecture hébergé pour comprendre vos fichiers.

Tableau de bord ArchiveBox auto-hébergé

Possédez toutes vos données

Les archives publiques centralisées sont essentielles, mais toutes les pages n’ont pas leur place dans un service public mondial. ArchiveBox permet aux individus et aux organisations de sauvegarder le matériel public ou privé auquel ils peuvent accéder, de le conserver localement ou au sein de leur institution et de décider quoi publier au cas par cas.

Exécutez-le en tant qu'application Web Docker, utilisez des commandes CLI uniques ou automatisez avec des API tout en gardant les données privées et publiques soigneusement séparées. Utilisez des fichiers ordinaires pour les sauvegardes et les exportations.

Contexte éthique et juridique

L'archivage responsable dépend de votre juridiction, de votre cas d'utilisation et de votre politique de publication. ArchiveBox est un outil ; les opérateurs restent responsables du traitement des données privées, des droits d’auteur, des demandes DMCA ou GDPR et des exigences légales locales.

Les instances publiques doivent publier les informations de contact et de suppression, éviter de monétiser le contenu copié et examiner la documentation de sécurité et de publication avant d'exposer les instantanés à des spectateurs anonymes.

Outils et communautés d'archivage Web associés

Vous recherchez une gestion spécialisée de l'exploration, de la relecture ou des favoris ? Explorez ces autres projets d’archivage Web.