Clean Web Clipper Ajouter à Chrome – gratuit

Clean Web Clipper

Les questions, avec des réponses simples

La plupart viennent de ce qu’on reproche aux autres clippers. Si votre question n’y est pas, écrivez à cws@lessroutinemorelife.com.

Questions

Une capture peut-elle se perdre sans que je m’en aperçoive ?
Non. Le fichier est écrit directement dans le dossier que vous avez choisi, et si un nom est déjà pris il devient Article-2.md au lieu d’écraser quoi que ce soit. Il n’y a ni gestionnaire de protocole ni boîte de dialogue du navigateur entre les deux, donc aucune étape où un clic malheureux ferait tomber la capture. La page des paramètres compte aussi combien de fois vous avez appuyé sur le bouton et combien de notes en sont sorties, si bien qu’un écart silencieux se verrait.
Obsidian doit-il être lancé ?
Non. Clean Web Clipper écrit le fichier .md directement dans un dossier choisi une fois, via l’API d’accès aux fichiers du navigateur. Obsidian peut être fermé, désinstallé ou totalement absent – le fichier apparaît quand même dans le dossier, et Obsidian le récupère à la prochaine ouverture du vault.
Pourquoi d’autres outils me donnent-ils parfois une note avec le titre seul, sans le corps ?
Parce que beaucoup de clippers transmettent la note par le presse-papiers, et que sous Linux avec Wayland seule la fenêtre active peut lire le presse-papiers. Si l’application cible n’a pas le focus à ce moment-là, le corps n’arrive jamais. Clean Web Clipper ne passe jamais par le presse-papiers pour enregistrer la note, donc cette panne n’existe pas ici.
Est-ce que ça marche sous Linux ?
Oui, comme ailleurs. Le gestionnaire de fenêtres, le presse-papiers et l’environnement de bureau ne jouent aucun rôle dans l’enregistrement, parce que le fichier est écrit par le navigateur lui-même.
Les tableaux sont-ils bien traités ?
Oui, et c’est mesuré. Sur un corpus de quinze tableaux, douze sont passés entiers, contre sept pour les moteurs comparés. Les tableaux sont sérialisés par notre propre code plutôt que par un convertisseur générique, donc une cellule contenant une liste ou un bout de code ne fait plus s’effondrer la ligne. Les cellules fusionnées sont dépliées, parce que le Markdown n’a aucun moyen d’exprimer une fusion.
Les images vont-elles sortir cassées ?
Non. Les images restent des liens Markdown ordinaires, sans échappement parasite, et s’affichent dès le collage. Ce que l’extension ne fait pas, c’est télécharger les fichiers d’images à côté de la note – le lien pointe vers l’original.
Que se passe-t-il sur une page qui n’est pas un article ?
L’extension le dit. Sur une boutique, un fil ou une page de résultats, il n’y a pas d’article à extraire, et au lieu de vous tendre trois cents libellés de liens elle écrit un marqueur extraction: no-article et s’arrête. La décision repose sur un seuil mesuré – quand plus d’un quart du texte se trouve dans des libellés de liens, c’est de la navigation, pas de la prose.
Envoie-t-elle mes pages quelque part ?
Vos pages, non. L’extraction et la conversion se font entièrement dans le navigateur, et ni le texte ni le titre d’une page n’en sortent. Quatre choses partent, vers notre propre serveur de statistiques : l’adresse d’une page où aucun article n’a été trouvé, pour que le site puisse être appris ; le seul domaine d’une capture réussie, jamais le chemin ; le nom de l’écran de l’extension que vous avez ouvert ; et un numéro d’installation aléatoire qui relie ces événements. Le serveur enregistre aussi une localisation approximative (pays, région et ville), déduite de l’adresse IP. L’adresse IP elle-même n’est pas conservée. Tout cela s’arrête dès que vous le désactivez dans les paramètres. L’accès à une page elle-même vient de votre propre clic, et seulement pour cet onglet.
Alors, qu’est-ce que le rapport d’utilisation dans les paramètres ?
Des compteurs qui vivent dans votre navigateur. Ils enregistrent combien de captures vous avez faites, combien de temps cela a fait gagner, quelle destination vous avez utilisée et où aucun article n’a pu être trouvé. Le rapport lui-même vous est montré en entier et ne part que si vous le copiez et l’envoyez vous-même par e-mail. Le panneau indique aussi combien d’adresses ont été envoyées, donc ce qui part ne sort jamais de votre vue.
Garde-t-elle une liste des pages que je visite ?
Non. Une capture réussie ne laisse derrière elle que son domaine – ni chemin, ni paramètres, ni titre, donc la liste ne peut pas montrer ce que vous avez lu sur un site, seulement que vous y avez capturé quelque chose. Les adresses complètes ne sont gardées que dans un cas, les pages où l’extraction a échoué, parce que c’est la seule chose sans laquelle aucune correction ne peut être écrite. Tout ce qui est gardé est visible dans le panneau et s’efface d’un bouton.
La date de publication sort-elle juste ?
Quand la page en déclare une, oui. Elle est lue dans JSON-LD, article:published_time, citation_date (le standard d’arXiv, PubMed et IEEE), time[datetime] et les horodatages Unix, dans cet ordre. Quand la page ne porte aucune date, le champ reste vide au lieu d’être rempli avec la date du jour. Certains types de sites – boutiques et horaires surtout – ne publient tout simplement jamais de date.
Puis-je ne capturer que la partie sélectionnée ?
Oui. Sélectionnez quelque chose sur la page et c’est cela qui est capturé ; ne sélectionnez rien et vous obtenez la page entière. Le sélecteur en haut de la fenêtre montre toujours ce que vous regardez, et ce comportement se désactive dans les paramètres.
Peut-elle traiter plusieurs onglets à la fois ?
Non. Clean Web Clipper travaille sur une page à la fois et n’a ni robot d’exploration ni traitement par lots. S’il vous faut des dizaines de pages d’un coup, ce n’est pas le bon outil.
Peut-elle surligner des passages sur la page, comme un marqueur ?
Non. Il n’y a ni surligneur ni couche d’annotation. L’extension convertit ce qui est déjà sur la page et n’y ajoute rien.
Résume-t-elle ou réécrit-elle le texte ?
Non. Le texte est converti, pas retouché – ni résumé, ni réordonné, ni réécrit. Ce que disait la page, la note le dit.
Dans quels navigateurs fonctionne-t-elle ?
Chrome et les autres navigateurs Chromium : Edge, Brave, Vivaldi, Opera, Arc. Elle est construite sur Manifest V3, donc elle ne cessera pas de fonctionner quand l’ancien format d’extension sera arrêté.
Est-ce gratuit ?
Oui, entièrement. Toutes les fonctions décrites ici sont dans l’extension installée : pas de limite de pages, pas de compte, pas d’inscription, pas de version payante.
Et si elle casse sur un site dont j’ai besoin ?
Écrivez à cws@lessroutinemorelife.com avec l’adresse. La page des paramètres contient un rapport qui liste déjà les sites où l’extraction a échoué, il suffit donc de le copier dans l’e-mail – inutile de décrire quoi que ce soit. Sur la page où elle a refusé, le bouton « J’ai besoin de ce site » place cette adresse en tête de la file des corrections.