Clean Web Clipper
Vragen, gewoon beantwoord
De meeste komen uit wat mensen over andere clippers klagen. Staat je vraag er niet bij, schrijf dan naar cws@lessroutinemorelife.com.
Vragen
Kan een clip verloren gaan zonder dat ik het merk?
Nee. Het bestand wordt rechtstreeks in de map geschreven die je koos, en is een naam al bezet, dan wordt het Article-2.md in plaats van dat er iets wordt overschreven. Er zit geen protocolhandler en geen browserdialoog tussen, dus er is geen stap waarop een verkeerde klik de clip laat vallen. De instellingenpagina telt ook hoe vaak je op de knop drukte en hoeveel keer dat een notitie opleverde, dus een stil gat zou zichtbaar zijn.
Moet Obsidian draaien?
Nee. Clean Web Clipper schrijft het .md-bestand rechtstreeks in een map die je één keer hebt gekozen, via de API voor bestandstoegang van de browser. Obsidian mag dicht zijn, verwijderd of er helemaal niet zijn – het bestand verschijnt hoe dan ook in de map, en Obsidian pikt het op zodra het de vault weer opent.
Waarom krijg ik in andere tools soms een notitie met alleen de titel en zonder tekst?
Omdat veel clippers de notitie via het klembord doorgeven, en op Linux onder Wayland mag alleen het venster met de focus het klembord lezen. Heeft de doel-app op dat moment geen focus, dan komt de tekst nooit aan. Clean Web Clipper zet de notitie nooit op het klembord om haar op te slaan, dus die fout bestaat hier niet.
Werkt het op Linux?
Ja, net als overal. De windowmanager, het klembord en de desktopomgeving spelen geen rol bij het opslaan, want het bestand wordt door de browser zelf geschreven.
Worden tabellen goed verwerkt?
Ja, en dat is gemeten. Op een corpus van vijftien tabellen bleven er twaalf heel, tegen zeven bij de vergeleken engines. Tabellen worden door onze eigen code geserialiseerd en niet door een generieke omzetter, dus een cel met een lijst of een stukje code laat de rij niet meer inzakken. Samengevoegde cellen worden platgeslagen, omdat Markdown geen samengevoegde cellen kent.
Komen afbeeldingen er kapot uit?
Nee. Afbeeldingen blijven gewone Markdown-links zonder verdwaalde escapetekens, dus ze worden getoond zodra je plakt. Wat de extensie niet doet, is afbeeldingsbestanden naast de notitie downloaden – de link wijst naar het origineel.
Wat gebeurt er op een pagina die geen artikel is?
Dan zegt de extensie dat. Op webwinkels, tijdlijnen en zoekresultaten valt geen artikel te extraheren, en in plaats van je driehonderd linkteksten te geven schrijft ze de markering extraction: no-article en stopt. De beslissing hangt aan een gemeten drempel – staat meer dan een kwart van de tekst in linkteksten, dan is het navigatie en geen lopende tekst.
Stuurt het mijn pagina’s ergens naartoe?
Je pagina’s niet. Extractie en omzetting gebeuren volledig in de browser, en geen paginatekst of titel verlaat die ooit. Vier dingen wel, naar onze eigen statistiekserver: het adres van een pagina waar geen artikel werd gevonden, zodat de extensie die site kan leren; alleen het domein van een geslaagde clip, nooit het pad; de naam van het scherm van de extensie dat je opende; en een willekeurig installatienummer dat die gebeurtenissen aan elkaar koppelt. De server legt ook een globale locatie vast – land, regio en stad – afgeleid uit het IP-adres; het adres zelf wordt niet opgeslagen. Alles stopt zodra je het in de instellingen uitzet. Toegang tot een pagina zelf geef je met je eigen klik, en alleen voor dat tabblad.
Wat is dan het gebruiksrapport in de instellingen?
Tellers die in je browser leven. Ze houden bij hoeveel clips je maakte, hoeveel tijd dat bespaarde, welke bestemming je gebruikte en waar geen artikel werd gevonden. Het rapport zelf krijg je volledig te zien, en het gaat alleen weg als je het kopieert en zelf mailt; het paneel toont ook hoeveel adressen er zijn verstuurd, dus wat eruit gaat blijft altijd in zicht.
Houdt het een lijst bij van de pagina’s die ik bezoek?
Nee. Een geslaagde clip laat alleen zijn domein achter en verder niets – geen pad, geen query, geen titel, dus de lijst kan niet laten zien wat je op een site las, alleen dat je daar clipte. Volledige adressen worden maar in één geval bewaard: bij pagina’s waar de extractie mislukte, omdat een reparatie zonder dat adres niet te schrijven is. Alles wat bewaard wordt, zie je in het paneel en wis je met één knop.
Klopt de publicatiedatum?
Als de pagina er een opgeeft, ja. Die wordt gelezen uit JSON-LD, article:published_time, citation_date (de standaard van arXiv, PubMed en IEEE), time[datetime] en Unix-stempels, in die volgorde. Draagt de pagina helemaal geen datum, dan blijft het veld leeg in plaats van dat de datum van vandaag wordt ingevuld. Sommige soorten sites – vooral webwinkels en dienstregelingen – publiceren gewoon nooit een datum.
Kan ik alleen het stuk clippen dat ik heb geselecteerd?
Ja. Selecteer iets op de pagina en dat wordt geclipt; selecteer niets en je krijgt de hele pagina. De schakelaar boven in het venster laat altijd zien welke van de twee je bekijkt, en dit gedrag is in de instellingen uit te zetten.
Kan het meerdere tabbladen tegelijk verwerken?
Nee. Clean Web Clipper werkt op één pagina tegelijk en heeft geen crawler en geen batchmodus. Heb je tientallen pagina’s in één keer nodig, dan is dit niet het juiste gereedschap.
Kan het passages op de pagina markeren, zoals een markeerstift?
Nee. Er is geen markeerstift en geen annotatielaag. De extensie zet om wat al op de pagina staat en voegt er niets aan toe.
Vat het de tekst samen of herschrijft het die?
Nee. De tekst wordt omgezet, niet geredigeerd: geen samenvatting, geen andere volgorde, niets herschreven. Wat er op de pagina stond, staat in de notitie.
In welke browsers werkt het?
Chrome en andere Chromium-browsers: Edge, Brave, Vivaldi, Opera, Arc. Het is gebouwd op Manifest V3, dus het blijft werken als het oude extensieformaat wordt uitgezet.
Is het gratis?
Ja, helemaal. Elke functie die hier beschreven staat, zit in de geïnstalleerde extensie: geen paginalimiet, geen account, geen registratie, geen betaalde versie.
Wat als het stukgaat op een site die ik nodig heb?
Schrijf naar cws@lessroutinemorelife.com met het adres. De instellingenpagina heeft een rapport waarin de sites waar de extractie mislukte al staan, dus dat in de mail plakken is genoeg – je hoeft niets te beschrijven. Op de pagina waar de extensie weigerde, zet de knop “Ik heb deze site nodig” dat adres vooraan in de reparatiewachtrij.