Guarda pestañas en segundos, las almacena durante décadas
Recopile marcadores para leer más tarde o conserve pruebas para casos legales con capturas verificables de nuestra Complemento de firma TLSNotary.
Archivo web autohospedado de código abierto
ArchiveBox guarda sitios web, marcadores, fuentes RSS, publicaciones sociales, medios, código fuente y material de investigación en archivos duraderos como HTML, PDF, PNG, TXT, JSON, WARC, MP4 y SQLite.
Ver capturas de pantalla ↗ · Ver demostración ↗
# Docker Compose es la configuración recomendada $ mkdir -p ~/archivebox/data && cd ~/archivebox $ curl -fsSL 'https://docker-compose.archivebox.io' > docker-compose.yml $ ventana acoplable componer -d --esperar -> inicializado ./data/index.sqlite3 ok escuchando en http://127.0.0.1:5797 $
Navega y guarda desde cualquier dispositivo.
Gratis, autohospedado, 0 análisis.
Por qué ArchiveBox
Recopile marcadores para leer más tarde o conserve pruebas para casos legales con capturas verificables de nuestra Complemento de firma TLSNotary.
Organice su colección con etiquetas y encuentre lo que necesita con la búsqueda de texto completo impulsada por sonic y ripgrep.
Extraiga automáticamente audio, vídeo, archivos git, publicaciones en foros, metadatos de SEO y más en archivos ordinarios Puedes abrir y reutilizar.
Dile a tu IA que inspeccione una página con abx-dl, generar un feed RSS cada 24 horas u organizar rastreos complejos a través de MCP y el REST API.
para quien es
Guarde marcadores, historial del navegador, fuentes RSS, redes sociales, contenido de formularios, vídeos, podcasts, música, fotografías y colecciones de conocimientos personales.
Guarde copias de artículos, material fuente y registros públicos, incluso después de que las páginas originales cambien o desaparezcan.

Apoye a OSINT, la investigación de redes sociales, los agentes de investigación impulsados por IA, las bibliotecas, los gobiernos y los equipos de creación de colecciones.

Obtener ArchiveBox
Elija cómo desea ejecutar su archivo. Se recomienda Docker Compose para la mayoría de las instalaciones.
Abra el enlace TestFlight en su iPhone o iPad para instalar ArchiveBox.
La guía de primera ejecución le ayuda a elegir un servidor o seleccionar ya tengo un servidor. Escanee el código QR de conexión desde ArchiveBox Server.app en su Mac, o ingrese la URL de su servidor y la clave API.
En Safari u otra aplicación, elija Compartir → ArchiveBox. Su servidor guarda la página para que pueda explorarla desde su teléfono.
Los APK beta de Android aparecerán aquí cuando se publiquen. Abra el APK y permita la instalación desde su navegador si Android lo solicita.
Utilice la guía de primera ejecución para elegir un servidor o seleccione ya tengo un servidor. En Configuración de conexión, ingrese la URL de su servidor y la clave API, luego verifique la conexión.
Elegir Compartir → ArchiveBox desde su navegador u otra aplicación, agregue etiquetas y guarde. Mantenga su servidor accesible para guardar y explorar páginas.
ArchiveBox.app
Aplicaciones
Elegir Configurar en esta Mac en la guía de configuración, luego descargue y abra ArchiveBox Server.app. ¿Ya tienes un servidor? Conéctese con su URL y clave API.
Utilice el Interfaz de usuario web, REST API, o CLI. Conecte el aplicación móvil, extensión del navegadory otros clientes que utilizan la URL de su servidor y la clave API.
ArchiveBoxDescargar Docker de escritorio e inícielo en su computadora. Mantenga Docker en ejecución mientras usa ArchiveBox.
Abra el instalador, inicie ArchiveBox y cree su cuenta de administrador. El primer lanzamiento prepara tu colección local.
Agregue una URL en la aplicación para archivar su primera página.
Descargar Docker de escritorio e inícielo en su computadora. Mantenga Docker en ejecución mientras usa ArchiveBox.
Abra el instalador, inicie ArchiveBox y cree su cuenta de administrador. El primer lanzamiento prepara tu colección local.
Agregue una URL en la aplicación para archivar su primera página.
Compose mantiene su configuración en un solo archivo y facilita las actualizaciones. Instalar ventana acoplable, luego cree un directorio y obtenga la configuración.
mkdir -p ~/archivebox/data && cd ~/archivebox
curl -fsSL 'https://docker-compose.archivebox.io' > docker-compose.ymldocker compose pull
docker compose up -d --waitUna nueva colección se inicializa automáticamente.
Abierto la interfaz de usuario del administrador para crear su primera cuenta de administrador y finalizar el asistente de configuración. En un servidor remoto, abra /admin/ en su nombre de host o IP.
docker compose exec archivebox archivebox add 'https://example.com'¿Tiene un archivo de redacción? Conviértelo a docker run comandos con Descomponerizar.
Instalar ventana acoplable primero.
mkdir -p ~/archivebox/data && cd ~/archivebox/data
docker run -d --name archivebox -v "$PWD:/data" -p 5797:5797 archivebox/archivebox:devAbierto la interfaz de usuario del administrador para crear su primera cuenta de administrador y finalizar el asistente de configuración. En un servidor remoto, abra /admin/ en su nombre de host o IP.
docker exec archivebox archivebox add 'https://example.com'
pip / uv
ArchiveBoxinstalar ultravioleta primero.
uv tool install --python 3.13 --prerelease explicit --upgrade 'archivebox>=0.9.0rc0,<0.10'
archivebox versionmkdir -p ~/archivebox/data && cd ~/archivebox/data
archivebox init
archivebox install
archivebox server 0.0.0.0:5797Abierto la interfaz de usuario del administrador para crear su primera cuenta de administrador y finalizar el asistente de configuración. En un servidor remoto, abra /admin/ en su nombre de host o IP.
Con Python 3.13 instalado, cree un entorno virtual e instale ArchiveBox:
python3.13 -m venv ~/.venvs/archivebox
source ~/.venvs/archivebox/bin/activate
python -m pip install --upgrade 'archivebox>=0.9.0rc0,<0.10'
archivebox versionLuego siga los pasos 2 y 3 anteriores. En cada nueva terminal, ejecute source ~/.venvs/archivebox/bin/activate antes de usar archivebox.
apt
ArchiveBoxecho 'deb [trusted=yes] https://archivebox.github.io/debian-archivebox dev main' | sudo tee /etc/apt/sources.list.d/archivebox.list
sudo apt update
sudo apt install archivebox
(cd /tmp && archivebox version)mkdir -p ~/archivebox/data && cd ~/archivebox/data
archivebox init
sudo archivebox install
archivebox server 0.0.0.0:5797Abierto la interfaz de usuario del administrador para crear su primera cuenta de administrador y finalizar el asistente de configuración. En un servidor remoto, abra /admin/ en su nombre de host o IP.
Homebrew
ArchiveBoxInstalar cerveza casera primero. Ejecute estos comandos como su usuario normal, sin sudo.
brew tap archivebox/archivebox
brew trust archivebox/archivebox
brew install archivebox
archivebox versionmkdir -p ~/archivebox/data && cd ~/archivebox/data
archivebox init
archivebox install
archivebox server 0.0.0.0:5797Abierto la interfaz de usuario del administrador para crear su primera cuenta de administrador y finalizar el asistente de configuración. En un servidor remoto, abra /admin/ en su nombre de host o IP.
Arch Linux
FreeBSD
Nada
ArchiveBoxLos paquetes comunitarios pueden ir por detrás de las versiones de Docker y Python.
yay -S archiveboxFreeBSD (atajo uv)
curl -fsSL 'https://get.archivebox.io' | bashnix-env --install archiveboxguix install archiveboxSiga las instrucciones de configuración de su paquete, luego use el Guía de uso de CLI para inicializar y administrar su archivo.
curl get.archivebox.io
| sh
ArchiveBoxcurl -fsSL 'https://get.archivebox.io' | bashPuede lee el guión antes de ejecutarlo.
Siga las instrucciones del instalador para comenzar a utilizar su colección.
Abierto la interfaz de usuario del administrador para crear su primera cuenta de administrador y finalizar el asistente de configuración. En un servidor remoto, abra /admin/ en su nombre de host o IP.
ArchiveBoxSiga la guía de instalación de la plataforma, configure el almacenamiento persistente y luego abra la aplicación para finalizar la configuración.
Para TrueNAS, consulte la Notas de la plataforma README antes de elegir una integración.
ArchiveBoxConsulte los planes actuales del proveedor, las versiones compatibles y las opciones de almacenamiento.
Utilice el flujo de implementación de ArchiveBox del proveedor, luego abra su instancia para crear una cuenta de administrador. Para un VPS no administrado, siga el inicio rápido de Docker Compose en su servidor.
Abra la página de configuración de la extensión, ingrese la URL de su servidor y la clave API, luego pruebe la conexión. Utilice una de las pestañas de instalación del servidor si aún no tiene un servidor.
Abra una página, haga clic en la extensión ArchiveBox y agregue sus etiquetas. También puedes importar marcadores e historial desde las opciones de la extensión.
Configuración
ArchiveBox se puede configurar a través de la interfaz de usuario de administración, CLI, ArchiveBox.conf, o importando configuraciones y cookies desde Chrome u otros navegadores. El mismo modelo de configuración funciona en Docker, Docker Compose, instalaciones básicas, trabajos programados y ejecuciones CLI únicas.
Usar TIMEOUT para redes lentas, CHECK_SSL_VALIDITY para sitios con certificados rotos, PUBLIC_INDEX, PUBLIC_SNAPSHOTS, y PUBLIC_ADD_VIEW para la política de publicación y la configuración del agente de usuario del navegador para sitios que bloquean bots obvios.
$ configuración de caja de archivo # ver configuración completa $ configuración de archivebox --obtener CHROME_BINARY $ configuración de archivebox --establecer TIMEOUT = 240 $ configuración de archivebox --set PUBLIC_INDEX=False $ env CHROME_BINARY=archivo de cromo agregar 'https://example.com'
ArchiveBox utiliza herramientas estándar como Chrome o Chromium, wget, curl, yt-dlp, git, SingleFile, Readability y analizadores de artículos. Docker agrupa estas dependencias para facilitar las actualizaciones y mejorar el aislamiento; Se pueden ejecutar instalaciones que no sean de Docker archivebox install y archivebox --version para comprobar lo que hay disponible.
Archivo una URL a la vez o programar importaciones de marcadores, historial del navegador, RSS, JSON, CSV, TXT, SQL, HTML, Markdown, Pocket, Pinboard, Instapaper, Shaarli, Wallabag, y más.
Guardar enlaces con nuestro extensión del navegador, o usar Mac y iPhone comparten menús, Siri y atajos.
Importe nuevas URL y capture instantáneas según una programacióny luego compare instantáneas para ver cómo han cambiado los sitios.
Capture cada página en varios formatos reutilizables:
Utilice la misma colección dondequiera que trabaje:
Diseño, exportación y seguridad del disco
Sus capturas son HTML, imágenes, PDF y archivos multimedia normales. Ábrelos desde Finder, búscalos con cualquier herramienta de búsqueda del sistema de archivos, deja que los agentes de IA los exploren directamente y haz una copia de seguridad de ellos como archivos normales.
Cada instantánea tiene una carpeta para cada método de captura. HTML vive en carpetas como dom/ y singlefile/; Las imágenes, los archivos PDF y los medios también tienen sus propias carpetas.
Los metadatos se almacenan en SQLite y JSON, con metadatos instantáneos junto con las salidas. La base de datos y la configuración de su colección se encuentran fuera de las carpetas de instantáneas y sus archivos siguen siendo legibles sin un servicio alojado.
Puede exportar el índice del archivo como HTML estático, JSON o CSV con archivebox list para que las colecciones se puedan revisar sin ejecutar el servidor web. Mantenga las exportaciones generadas junto al archive/ carpeta para que las rutas relativas de instantáneas sigan funcionando.
$ lista de cuadros de archivo --html --con-encabezados > index.html $ lista de cuadros de archivo --json --con-encabezados > index.json $ lista de cuadros de archivo --csv=marca de tiempo,url,título > index.csv
Archive URL privadas, páginas de pago, medios no listados y Google Docs mediante un perfil de Chrome importado o un personaje de navegador dedicado. Elige qué capturas permanecen privadas y quién puede acceder a ellas.
Restringir el acceso público con PUBLIC_INDEX=False, PERMISSIONS=private, y PUBLIC_ADD_VIEW=False, luego cree usuarios autenticados con archivebox manage createsuperuser.
ArchiveBox utiliza un Navegador Chrome durante el archivado para ejecutar JavaScript y capturar la página renderizada.
ArchiveWeb.page registra páginas para su reproducción, incluidos sus guiones y respuestas de la red. Reproduzca páginas capturadas con JavaScript usando ReplayWeb.page, visor de archivos de Webrecorder.
ArchiveBox puede utilizar aproximadamente de 1 GB a 50 GB por cada 1000 instantáneas, según la configuración de medios, vídeo, audio y extractor. Melodía YTDLP_ENABLED y YTDLP_MAX_SIZE para colecciones con muchos medios.
Mantener index.sqlite3 en almacenamiento local o SSD cuando sea posible. Grande archive/ Las carpetas pueden vivir NFS, SMB, FUSE, Respaldado por S3, o Almacenamiento en disco duro, pero es posible que sea necesario configurar Docker y archivos compartidos. ajustes de propiedad y calabazas de raíz. Evite sistemas de archivos más antiguos como EXT3 o FAT para archivos muy grandes.
Antecedentes y motivación
ArchiveBox existe porque la descomposición de los enlaces, la rotación de plataformas, la censura y la desaparición de los medios borran de forma rutinaria el conocimiento útil. El proyecto tiene como objetivo hacer que el contenido web que le interesa sea visible con software común dentro de 50 a 100 años, sin necesidad de ArchiveBox o un servicio de reproducción alojado para comprender sus archivos.
Los archivos públicos centralizados son esenciales, pero no todas las páginas pertenecen a un servicio público global. ArchiveBox permite a individuos y organizaciones guardar material público o privado al que puedan acceder, conservarlo localmente o dentro de su institución y decidir qué publicar caso por caso.
Ejecútelo como una aplicación web Docker, use comandos CLI únicos o automatice con API mientras mantiene los datos públicos y privados claramente separados. Utilice archivos normales para copias de seguridad y exportaciones.
El archivado responsable depende de su jurisdicción, su caso de uso y su política de publicación. ArchiveBox es una herramienta; Los operadores siguen siendo responsables del manejo de datos privados, derechos de autor, solicitudes de DMCA o GDPR y requisitos legales locales.
Las instancias públicas deben publicar información de contacto y eliminación, evitar monetizar el contenido copiado y revisar la documentación de seguridad y publicación antes de exponer instantáneas a espectadores anónimos.
¿Busca una gestión especializada de rastreo, reproducción o marcadores? Explore estos otros proyectos de archivo web.