Para quién es
Guarda lo que lees en un formato duradero
Los marcadores apuntan a páginas que cambian o desaparecen; una captura es el texto en sí. Clean Clipper escribe texto plano con frontmatter YAML en la carpeta que tú decidas, sin cuenta, sin servidor y sin ninguna petición de red. Lo que guardas hoy se abre dentro de diez años con cualquier editor.
La biblioteca que se evapora
Una carpeta de marcadores de diez años es, en buena parte, una lista de páginas que ya no existen: blogs cerrados, medios que rehicieron su web, servicios que se apagaron con un aviso de tres meses. Lo que creías tener guardado eran direcciones, no textos. Y la diferencia entre una cosa y otra solo se descubre el día que vas a buscar el texto.
Los servicios de lectura para más tarde tienen el mismo final. Guardan tu biblioteca en su servidor, en su formato, y la exportación llega tarde o llega incompleta. Cambiar de herramienta significa migrar otra vez, y cada migración pierde algo por el camino.
Y luego está la razón por la que casi nadie archiva: cuesta una decisión cada vez. Guardar parece trabajo, la página parece que va a seguir ahí, y el momento en que se descubre lo contrario llega años después. Por eso importa que el gesto sea trivial: la captura tarda decenas de milisegundos, no hay límite de páginas ni cuota diaria ni cuenta que crear, y cada archivo pesa lo que pesa el texto del artículo, porque no se descarga ningún binario.
Qué cambia en tu archivo
- Formato abierto y duradero: texto plano con frontmatter YAML
- Sin cuenta y sin servidor: la extensión no hace ninguna petición de red
- La fecha de publicación y la dirección de origen se guardan junto con el texto
- Los archivos se leen sin conexión, hoy y dentro de diez años
- El campo
extractionregistra cómo se obtuvo cada nota, así que el archivo es auditable - Todo se busca con el buscador de tu sistema, sin índice ni aplicación intermedia
- Sin límite de páginas ni cuota diaria: nada que renovar y nada que caduque
- Volver a capturar la misma dirección añade un sufijo numérico, así que las versiones sucesivas conviven
Recortes/
├── 2021/
│ ├── 2021-03-08-el-final-de-flash.md
│ └── 2021-11-19-que-fue-de-los-lectores-rss.md
├── 2024/
│ └── 2024-06-02-copias-de-seguridad-en-frio.md
└── 2025/
└── 2025-08-14-formatos-que-siguen-abriendose.md
Cuatro archivos de texto. Ningún servicio de por medio, ninguna base de
datos, nada que haya que exportar antes de que cierre.Cómo montar un archivo personal
Un archivo sirve si se puede buscar dentro de diez años sin la herramienta que lo creó. Estos seis pasos apuntan justo a eso, y no a la comodidad del primer día.
- Decide la estructura antes que nada: una carpeta madre y dentro una subcarpeta por año es lo que mejor aguanta, porque no depende de categorías que dejarán de tener sentido. Señala la carpeta madre en los ajustes de la extensión.
- Pon la plantilla de nombre en
{date}-{title}. Con la fecha delante, la carpeta cuenta la cronología por sí sola, y{date}es el día de la captura, que en un archivo personal es el dato que de verdad ordena. - Deja activos los cinco campos del frontmatter.
sourceypublishedson lo que hace que una nota siga siendo una referencia dentro de diez años, yextractiondeja escrito por qué vía se obtuvo el texto de cada una. - Pon el clic en el icono en «carpeta». Archivar tiene que costar un gesto: en cuanto exige una decisión, deja de hacerse, y ese es el motivo real por el que la mayoría de la gente no tiene archivo.
- Comprueba Alt+Shift+M en
chrome://extensions/shortcutsy acostúmbrate a pulsarlo al terminar de leer, antes de cerrar la pestaña. Es el único momento en que la página está garantizada. - Añade la carpeta a tus copias de seguridad, con lo que ya uses. Ahí termina el trabajo: no hay nada más que exportar, porque el formato final ya es el formato en que se guarda.
Ajustes para que dure
Los valores de abajo priorizan la durabilidad por encima de la comodidad inmediata. Es la diferencia entre una carpeta que se consulta dentro de una década y una que se abandona en dos años.
| Ajuste | Valor | Por qué así en un archivo |
|---|---|---|
| Clic en el icono | Carpeta | Un gesto y ya está: en cuanto archivar exige una decisión, deja de ocurrir |
| Carpeta y subcarpeta | Carpeta madre → el año | El año no envejece como categoría; los temas que elijas hoy dejarán de encajar en cinco años |
| Plantilla de nombre | `{date}-{title}` | La carpeta queda ordenada cronológicamente sin abrir un solo archivo ni depender de ningún índice |
| Frontmatter | Los cinco campos | `source` y `published` sostienen la referencia; `extraction` deja constancia de cómo se obtuvo cada texto |
| Imágenes | Enlace | Los binarios no se descargan; el enlace al menos deja escrito qué imagen había y de dónde salía |
| Copias de seguridad | La carpeta entera, como cualquier otra | No hay formato propietario ni exportación pendiente: lo que se copia ya es el resultado final |
| Atajo de teclado | Alt+Shift+M | Capturar al terminar de leer, antes de cerrar la pestaña, es el único momento garantizado |
2024/ └── 2024-05-06-el-formato-que-sobrevivio-a-su-editor.md 2025/ └── 2025-05-06-el-formato-que-sobrevivio-a-su-editor-2.md --- (captura de 2024) title: "El formato que sobrevivió a su editor" source: "https://www.microsiervos.com/archivo/formato-sobrevivio-editor.html" published: "2024-05-06" extraction: "dom" --- --- (captura de 2025, tras el rediseño del sitio) title: "El formato que sobrevivió a su editor" source: "https://www.microsiervos.com/archivo/formato-sobrevivio-editor.html" published: "2024-05-06" extraction: "jsonld-articlebody" --- La fecha de publicación no cambió: es la del artículo, no la de la visita. Lo que cambió es la vía: tras el rediseño la página no terminó de renderizarse y el cuerpo hubo que leerlo de los datos estructurados. El campo extraction deja eso escrito, así que el archivo es auditable.
Tres casos reales
El gesto de cada día
Terminas de leer algo que quieres conservar y pulsas Alt+Shift+M antes de cerrar la pestaña. No se abre nada, no hay que elegir carpeta ni nombre: el archivo cae en la subcarpeta del año con la fecha y el título en el nombre.
A los tres años eso son unos cuantos miles de archivos de texto que ocupan menos que un puñado de fotografías, porque no se descarga ningún binario. Y no hay ningún límite que llegue a estorbar: ni cuota diaria, ni cuenta, ni número máximo de páginas.
Rescatar un sitio que va a cerrar
Un blog anuncia que baja la persiana en un mes. Recorres lo que quieres conservar y lo capturas entrada por entrada: no hay rastreo, así que es trabajo manual, y la contrapartida es que eliges tú qué merece la pena en lugar de descargar mil páginas.
Lo que queda es texto con su autor, su fecha y su dirección de origen. Lo que no queda son las imágenes: son enlaces al sitio que va a cerrar, y con él se irán. Si las imágenes importan, hay que guardarlas aparte antes de la fecha, porque eso la extensión no lo hace.
Cambiar de equipo sin migrar nada
Llega un equipo nuevo. Copias la carpeta y ahí termina la migración: no hay base de datos que exportar, ni formato que convertir, ni servicio del que darse de baja. Los archivos se abren igual en el sistema nuevo.
Lo único que hay que rehacer son los ajustes de la extensión, que viven en el almacenamiento local de cada navegador y no viajan: elegir otra vez la carpeta y volver a escribir la plantilla de nombre. Un minuto, y contra eso está la ventaja de que ningún ajuste se sincronice a ninguna parte.
Frente a las otras formas de archivar
Cada vía guarda algo distinto, y para un registro visual completo hay opciones mejores que esta. La última fila dice lo que esta extensión guarda y lo que no.
| Cómo se hace ahora | Qué obtienes | Qué cuesta |
|---|---|---|
| Marcadores | Un índice de todo lo leído, sin esfuerzo | Guarda direcciones, no textos: a los diez años buena parte no lleva a ninguna parte |
| Servicio de lectura para más tarde | Biblioteca ordenada, sincronizada y con buscador | Vive en su servidor y en su formato; la exportación llega tarde o incompleta, y el servicio puede cerrar |
| Guardar la página completa | Texto, imágenes y estilos en un solo paquete | Una carpeta o un archivo empaquetado por página, difícil de buscar en conjunto y atado a que el navegador siga abriéndolo |
| Imprimir a PDF | La página tal como se veía, en un formato estable | Pesa, se busca peor y no se reutiliza: el texto hay que volver a extraerlo si algún día se necesita |
| Servicio de archivo web | Registro visual con marca de tiempo de un tercero | Depende de que llegue a la página; lo que está tras una sesión o un muro no se archiva |
| Clean Clipper | Texto plano con metadatos, en tu carpeta, sin cuenta ni servicio | No guarda maquetación ni imágenes, no captura por su cuenta, no sincroniza y no hace copias de seguridad |
Cuando el archivo falla
¿Por qué las imágenes de mis capturas antiguas ya no se ven?
Porque nunca estuvieron en tu disco. No se descargan archivos binarios: las imágenes quedan como enlaces al sitio original, y cuando ese sitio se rediseña, cambia de dominio o cierra, el enlace deja de resolver. El texto no se ve afectado. Si en algún material las imágenes son el contenido –una infografía, un mapa–, hay que guardarlas aparte en el momento de capturar.
¿Puedo recuperar una página que ya ha desaparecido?
No. La extensión captura lo que tu navegador está mostrando; si la página ya no existe, no hay nada que leer. Para eso están los archivos web públicos, que a veces conservan una copia. Es la razón de fondo por la que el gesto tiene que ser barato: solo se puede archivar antes.
¿Por qué algunas capturas dicen jsonld-articlebody?
Porque en esas páginas el navegador no llegó a mostrar el cuerpo y el texto se leyó de los datos estructurados del propio sitio. El contenido es el mismo, pero por esa vía suelen perderse detalles de formato: la posición de las notas, alguna tabla, las etiquetas de lenguaje de los bloques de código.
Tenerlo escrito en cada archivo es lo que hace el archivo auditable. Diez años después puedes buscar en toda la carpeta las capturas con ese valor y revisarlas primero, en lugar de desconfiar del conjunto entero.
¿Por qué el archivo no conserva el aspecto de la página?
Porque guarda el texto y no la página: no hay maquetación, ni hojas de estilo, ni capturas de pantalla, ni tipografías. Es una decisión, no una carencia: el texto plano es lo único que se abre con cualquier programa dentro de una década, y el diseño es justo la parte que ningún formato conserva bien a largo plazo. Cuando lo que importa es el aspecto, lo que hace falta es un servicio de archivo web.
Lo que no hace
No guarda la página, sino su texto: no hay maquetación, ni capturas de pantalla, ni hojas de estilo. No descarga las imágenes, el vídeo ni ningún archivo binario; las imágenes quedan como enlaces al sitio original, así que si ese sitio cae, la imagen cae con él. No sincroniza ni hace copias de seguridad por ti: eso lo decide lo que hagas con la carpeta. Y no captura páginas por su cuenta: guardas lo que lees, cuando lo lees.
Preguntas
¿Y si la extensión deja de mantenerse?
¿Guarda las imágenes?
¿Hay algún límite de cuánto puedo capturar?
¿Cómo busco dentro del archivo años después?
.md corrientes, así que no hace falta ninguna aplicación concreta.¿Puedo capturar páginas que solo veo con sesión iniciada?
¿Cuánto ocupa un archivo de varios años?
¿Puedo capturar la misma página en varios momentos?
¿Hace falta una aplicación concreta para leer el archivo?
.md, texto plano: se abren en cualquier editor, se buscan con el buscador del sistema y se imprimen sin nada instalado. Obsidian o Logseq añaden navegación, pero no son un requisito.