Clean Clipper Lägg till i Chrome – gratis

Chrome-tillägg

Spara en webbsida som Markdown du slipper städa efteråt

Clean Clipper sparar en webbsida som Markdown med ett klick: titel, författare, publiceringsdatum och källa hamnar i frontmatter, brödtexten kommer utan navigering. Allt sker inne i din webbläsare – inget konto, ingen server, ingen telemetri.

Clean Clipper-fönstret med Markdown från en sparad Wikipedia-artikel
Lägg till i Chrome – gratisHelt gratis. Inget konto, ingen registrering, inga gränser.

Problemet är aldrig omvandlingen. Det är allt som följer med.

Alla clippers gör HTML till Markdown. Sedan öppnar du anteckningen och hittar kakbannern, sidomenyn, en ”Läs också”-lista och en tabell som föll isär på vägen in. Clean Clipper är byggt kring att ta bort just det, och borttagningen är mätt i stället för påstådd.

vad andra clippers behåller

[Hoppa till innehållet](#main) [Logga in](/logga-in) [Bli medlem](/prenumerera)
[Start](/) [Nyheter](/nyheter) [Sport](/sport) [Kultur](/kultur) [Mer](/mer)

Vi använder kakor och liknande tekniker för att förbättra din upplevelse.
[Godkänn alla] [Hantera inställningar]

# Artikeln du kom för att läsa

Textens faktiska första stycke.

<div class="promo-inline">

## Läs också
[En annan rubrik](/a) [Ytterligare en](/b) [Och en tredje](/c)

vad som hamnar i anteckningen

# Artikeln du kom för att läsa

Textens faktiska första stycke.

Det här gör utdatan ren

Verklig utdata, oredigeradsv.wikipedia.org/wiki/Markovkedja
---
title: "Markovkedja – Wikipedia"
source: "https://sv.wikipedia.org/wiki/Markovkedja"
date: "2004-11-18T09:23:07.000Z"
extraction: "dom"
---

En markovkedja är en stokastisk process där sannolikheten för varje händelse
enbart beror på det tillstånd som uppnåddes i den föregående händelsen.[^1]

[^1]: Markov, A. A. (1906). Utvidgning av de stora talens lag till storheter
      som beror av varandra.

Mätt på 512 sidor från världens mest besökta webbplatser

Två körningar. Den första tog 109 sidor från de hundra mest besökta webbplatserna i världen och i Ryssland och jämförde utdatan med tre andra extraheringsmotorer. Den andra tog de femtio största webbplatserna i vart och ett av tolv europeiska länder – 403 sidor till, varje sida hämtad på landets eget språk.

512sparade sidor totalt
0misslyckanden
0kvarlämnade HTML-taggar
102dubblerade menyrader, mot 282, 478 och 491 för de tre andra motorerna

Var det sparas

Vad klicket på ikonen gör bestämmer du. Behåll förhandsvisningen, eller låt ett klick lägga anteckningen i vaultet utan att öppna någonting alls.

Inställningarna i Clean Clipper: att välja vad klicket på ikonen gör
Inställningarna avgör vad ett klick gör – förhandsvisning, urklipp, fil, mapp eller rakt in i vaultet.

Ärligt om källan

Varje anteckning märks med ett extraction-fält. dom betyder att texten kom från det webbläsaren faktiskt renderade. jsonld-articlebody betyder att sidan aldrig renderade färdigt och att brödtexten fick läsas ur sidans egna strukturerade data. Och när det inte finns någon artikel alls på sidan – en butik, ett flöde, ett sökresultat – säger tillägget det i stället för att kasta trehundra länkar på dig.

Femton sätt att använda det

UtvecklareKodblock behåller sin språkmärkning, så inklistrad dokumentation färgläggs direkt.

Clean Clipper läser kodblockets språk ur sidan själv – ur klassen på blocket, ur föräldraelementet eller ur färgläggarens egen uppmärkning – och skriver in det i Markdown-texten. På ett tekniskt korpus överlevde märkningen i 73 av 156 kodblock, mot 20 och 0 för de två jämförda motorerna.

  • Ett block kommer ut som ```js och inte naket – färgläggningen fungerar i Obsidian, VS Code och på GitHub i samma sekund du klistrar in
  • Märkningen kommer från sidan själv: klassen färgläggaren lämnat efter sig, inte en gissning utifrån koden
  • Tabeller med ett kodexempel i en cell klappar inte ihop till en enda rad
Läs mer
Obsidian-användarePeka ut en mapp i vaultet en gång, så hamnar varje sparad sida där som .md-fil.

Tillägget skriver anteckningen själv, till den mapp du pekar ut, via webbläsarens File System Access API. Ingen community-plugin är inblandad, inget lokalt REST API och ingen obsidian://-länk, och Obsidian behöver inte vara igång: filen ligger där nästa gång du öppnar vaultet.

  • Ingen plugin, ingen lokal server, inga obsidian://-länkar – tillägget skriver filen själv
  • Obsidian behöver inte vara öppet; filen finns där nästa gång du öppnar vaultet
  • YAML-frontmatter med title, source, author, published och extraction, och du väljer vilka fält som stannar
Läs mer
AI och språkmodellerUpprepad navigering är bortkastad kontext. Den försvinner innan texten når modellen.

En webbsida du klistrar in i en modell består till en dryg del av navigering, och varje dubblerad menyrad räknas som kontext. På ett korpus om 109 sidor lämnade Clean Clipper 102 dubblerade navigeringsrader, där tre andra motorer lämnade 282, 478 och 491. Kvar blir texten, med källadressen och datumet i frontmatter.

  • Ungefär fyra gånger mindre dubblerad navigering än genomsnittet för de jämförda motorerna
  • Noll kvarlämnade HTML-taggar över 512 mätta sidor – ingen uppmärkning att läsa sig förbi
  • Frontmatter ger modellen källadressen och publiceringsdatumet uttryckligen
Läs mer
ForskareLäser citation_date, standarden hos arXiv, PubMed och IEEE, och lägger fotnoterna sist.

Datumet kommer ur sidans metadata och inte ur en gissning på texten: citation_date, JSON-LD datePublished, article:published_time, time[datetime] och Unix-stämplar läses i den ordningen. Bär sidan inget datum lämnas fältet tomt. Referenslänkar blir [^1]-fotnoter med sina definitioner sist i anteckningen.

  • Läser citation_date och citation_publication_date – metataggarna som arXiv, PubMed och IEEE skickar med
  • Dessutom JSON-LD datePublished, article:published_time, time[datetime] och Unix-stämplar
  • Inget datum på sidan betyder ett tomt fält, aldrig dagens datum
Läs mer
StudenterFöreläsningar, kapitel och uppslagssidor blir vanliga Markdown-filer på din egen disk.

Kursmaterial försvinner när terminen är slut: lärplattformen stängs, länken ruttnar och pdf-filen ligger bakom en inloggning du inte längre har. En sparad sida är ren text med källan kvar, och den öppnas i vilken redigerare som helst om tio år. Markerar du något på sidan sparas bara markeringen.

  • Markera ett stycke så sparas bara markeringen – praktiskt när du vill citera en definition
  • Varje anteckning bär källadressen, så det kostar ingen sökning att hänvisa till den senare
  • Publiceringsdatumet läses där sidan bär ett, och lämnas annars tomt
Läs mer
SkribenterVarje sparad sida behåller källadress, författare och publiceringsdatum.

Det du sparar som skärmbild eller bokmärke är oanvändbart just i det ögonblick du ska ange källan: du minns inte längre vem som skrev det eller när. Markdown med frontmatter håller ihop title, author, published och source med texten i samma fil, och författarhämtningen filtrerar bort avsnittsrubriker och knapptexter i stället för att skriva dit något.

  • Title, author, published och source i frontmatter i varje anteckning
  • Artikeltexten utan navigering, färdig att citera ur
  • Författarhämtningen filtrerar bort avsnittsrubriker, förlagsnamn och knapptexter
Läs mer
JournalisterSidan som du såg den, med publiceringsdatum, i ett format som överlever webbplatsen.

Sidor skrivs om och plockas ned, oftast utan att det står något om det. En sparad kopia med källadress, publiceringsdatum och hela texten är ett underlag du kan peka på senare, och den ligger på din egen disk. Fältet extraction antecknar dessutom hur texten hämtades, så anteckningen går att granska.

  • Publiceringsdatumet läses ur sidans egna metadata, inte ur brödtexten
  • Källadressen i frontmatter i varje anteckning, så ursprunget följer med
  • Hela artikeltexten utan navigering och puffar som byts ut mellan besöken
Läs mer
Juridiskt arbeteTexten som den är publicerad, med källadress och datum, i en fil du själv råder över.

Föreskrifter, villkor och vägledningar ändras utan förvarning. En Markdown-kopia med adressen den kom från och datumet den bar visar vad texten sa när du läste den. Inne i artikeltexten läggs inga ord till, tas inga bort och flyttas ingenting om; det är bara HTML som blir Markdown.

  • Ordagrann text – tillägget sammanfattar inte, skriver inte om och kastar inte om något
  • Källadress och publiceringsdatum i frontmatter, så fyndplatsen följer med
  • Tabeller över avgifter, tidsfrister och beloppsgränser överlever omvandlingen hela
Läs mer
AnalytikerEgen tabellserialisering: en cell med lista, länk eller kod bryter inte längre raden.

Generiska omvandlare från HTML till Markdown går sönder på just de tabeller som betyder något. Clean Clipper skriver tabellen själv och plattar ut cellinnehållet i stället för att tappa raden: på ett korpus med femton tabeller förblev tolv hela, mot sju för var och en av de jämförda motorerna.

  • Egen GFM-tabellserialisering i stället för en generisk plugin
  • Tolv tabeller av femton behållna på det tekniska korpuset, mot sju för var och en av de jämförda motorerna
  • En cell med en lista, en länk eller ett kodexempel plattas ut, den utelämnas inte
Läs mer
LärareSpara materialet, behåll källan, skriv ut det – utan webbplatsens inredning.

En sida som skrivs ut direkt ur webbläsaren tar med sig menyer, kakbanner och annonser till underlaget. Clean Clipper skriver ut den sparade texten och inte sidan: bara innehållet, med källadressen kvar så att hänvisningen stämmer. Vill du ha en enda övning eller en enda definition markerar du den och sparar markeringen.

  • En utskriftsknapp som skriver ut den sparade texten och inte sidan, utan menyer och banners
  • Läsläget visar resultatet utan Markdown-tecken innan du skriver ut
  • Källadressen stannar i anteckningen, så källhänvisningen kostar ingen möda
Läs mer
ÖversättareNavigering, banners och upprepade menyer når aldrig segmentlistan.

Källtext som klistras in från en webbsida bär med sig navigeringen, och varje menypost blir ett segment du måste hoppa över. Clean Clipper klipper bort det före exporten: på ett korpus om 109 sidor återstod 102 dubblerade navigeringsrader, mot 282, 478 och 491 hos de tre andra motorerna. Det du importerar är brödtext.

  • Menyer, sidnumrering, kakbanners och ”Läs också”-block klipps bort före exporten
  • Dubblerade navigeringsrader ungefär fyra gånger färre än hos de jämförda motorerna
  • Vanlig Markdown importeras i alla större CAT-verktyg
Läs mer
ProduktcheferÄndringsloggar, dokumentation och release notes som daterade, sökbara anteckningar.

Omvärldsbevakning som samlas som bokmärken förfaller till en lista länkar du inte kan söka i. Sparad som Markdown blir den ett korpus du kan söka i, jämföra och citera i ett beslutsunderlag – med sidans eget publiceringsdatum, så att en post i en ändringslogg behåller sin verkliga tidpunkt.

  • Publiceringsdatumet läses ur sidan, så en post i en ändringslogg behåller sin verkliga tidpunkt
  • Med regler per webbplats hamnar varje konkurrent i sin egen mapp av sig själv
  • Tabeller över planer, gränser och funktionsjämförelser överlever hela
Läs mer
TeknikinformatörerStruktur, kodblock och tabeller följer med; webbplatsens inredning gör det inte.

Att migrera dokumentation brukar innebära att man omvandlar HTML och sedan lägger längre tid på att ta bort det omvandlaren behöll. Borttagningen är det Clean Clipper är byggt kring, och den är också den del som är mätt: noll kvarlämnade HTML-taggar över 512 sidor, och språkmärkningar som sitter kvar på kodblocken.

  • Rubriker, listor, tabeller, kodblock och fotnoter blir alla vanlig Markdown
  • Språkmärkningen sitter kvar på kodblocken – 73 av 156 på det tekniska korpuset, mot 20 och 0
  • Noll kvarlämnade HTML-taggar över 512 mätta sidor
Läs mer
Personligt arkivVanliga Markdown-filer på din egen disk. Inget konto, ingen tjänst som kan läggas ned.

Bokmärken pekar på sidor som ändras eller försvinner. En sparad kopia är själva texten, i ren text med YAML-frontmatter, lagrad där du bestämmer. Tillägget gör inga nätverksförfrågningar alls, så det finns inget konto som kan gå ut och ingen tjänst som kan dra in din åtkomst.

  • Beständigt öppet format: ren text med YAML-frontmatter, läsbar i vilken redigerare som helst
  • Inget konto och ingen server – tillägget gör inga nätverksförfrågningar alls
  • Publiceringsdatum och källadress fångas tillsammans med texten
Läs mer
Läsa utan brusEtt läsläge som visar texten utan menyer, utan banners och utan Markdown-tecken.

Sidinredning är inte bara visuellt stök: det är text som en skärmläsare läser upp och en läsare måste hoppa över. Fönstret visar artikeln för sig själv, i webbläsarens ljusa eller mörka tema, och inga skript från sidan kör med. Det du sparar är ren text som vilket hjälpmedel som helst klarar.

  • Visar den sparade texten som vanlig text, utan Markdown-tecken, med rubriker, tabeller och fungerande länkar
  • Följer webbläsarens inställning för ljust och mörkt
  • Förstoras till ett fönster på tre fjärdedelar av skärmen, så att sidan bakom syns kvar
Läs mer

Frågor

Skickar Clean Clipper mina sidor någonstans?
Nej. Extrahering och omvandling sker helt inne i din webbläsare. Kopian går till urklipp och filen till din disk. Det finns inget konto, ingen analys och ingen förfrågan till tredje part. Tillägget begär inga host-behörigheter och kan alltså inte läsa en sida du inte har klickat på.
Måste Obsidian vara igång för att spara till vaultet?
Nej. Clean Clipper skriver filen direkt till en mapp du gett åtkomst till, via webbläsarens File System Access API. Obsidian plockar upp filen nästa gång det tittar i vaultet.
Vad händer på en sida som inte är en artikel?
Tillägget säger ifrån. På butiker, flöden och sökresultat finns ingen artikel att extrahera, och sparandet markeras som ”ingen artikel” i stället för att ge dig en sida full av länkar.
Vilka webbläsare fungerar det i?
Chrome och andra Chromium-webbläsare: Edge, Brave, Vivaldi, Opera. Det är ett Manifest V3-tillägg utan host-behörigheter.
Är det gratis?
Ja, helt och hållet. Allt som beskrivs på den här sajten finns i tillägget du installerar: obegränsat sparande, Obsidian-vaultet, regler per webbplats, fotnoter, tabeller, språkmärkta kodblock, läsläget och alla fjorton gränssnittsspråken. Det finns ingen betalversion, inget konto och ingen registrering.