Clean Web Clipper Lägg till i Chrome – gratis

Chrome-tillägg ·

Spara en webbsida som Markdown du slipper städa efteråt

Clean Web Clipper sparar en webbsida som Markdown med ett klick: titel, författare, publiceringsdatum och källa hamnar i frontmatter, brödtexten kommer utan navigering. Allt sker inne i din webbläsare – inget konto, och sidans text lämnar aldrig webbläsaren.

Lägg till i Chrome – gratisHelt gratis, inget konto, inga gränser. Extraheringen fungerar offline; användningshändelser skickas när du är uppkopplad, och en enda knapp stoppar dem.For Chrome on a computer
Clean Web Clipper-fönstret med Markdown från en sparad Wikipedia-artikel

Clean Web Clipper är ett gratis Chrome-tillägg som sparar en webbsida som ren Markdown – till urklipp, en .md-fil, en mapp eller rakt in i ett Obsidian-vault – utan konto och utan inloggning. Testat på 512 sidor från de mest besökta webbplatserna: inga krascher och inga kvarlämnade HTML-taggar i någon extraherad artikel.

Testat på 512 sidor från världens mest besökta webbplatser

Två körningar. Den första tog 109 sidor från de hundra mest besökta webbplatserna i världen och i Ryssland och jämförde utdatan direkt med tre andra extraheringsmotorer. Den andra tog de femtio största webbplatserna i vart och ett av tolv europeiska länder – 403 sidor till, varje sida hämtad på landets eget språk och körd genom enbart vår kärna. Motorer, versioner, datum och var det ligger efter

512testade sidor
0krascher
0kvarlämnade HTML-taggar i extraherade artiklar
102dubblerade menyrader på 109 sidor, mot 282, 478 och 491 för de tre andra motorerna

Problemet är aldrig omvandlingen. Det är allt som följer med.

Alla clippers gör HTML till Markdown. Sedan öppnar du anteckningen och hittar kakbannern, sidomenyn, en ”Läs också”-lista och en tabell som föll isär på vägen in. Clean Web Clipper är byggt kring att ta bort just det, och borttagningen är mätt i stället för påstådd.

vad andra clippers behåller

[Hoppa till innehållet](#main) [Logga in](/logga-in) [Bli medlem](/prenumerera)
[Start](/) [Nyheter](/nyheter) [Sport](/sport) [Kultur](/kultur) [Mer](/mer)

Vi använder kakor och liknande tekniker för att förbättra din upplevelse.
[Godkänn alla] [Hantera inställningar]

# Artikeln du kom för att läsa

Textens faktiska första stycke.

<div class="promo-inline">

## Läs också
[En annan rubrik](/a) [Ytterligare en](/b) [Och en tredje](/c)

vad som hamnar i anteckningen

# Artikeln du kom för att läsa

Textens faktiska första stycke.

Det här gör utdatan ren

Verklig utdata, oredigeradsv.wikipedia.org/wiki/Markovkedja
---
title: "Markovkedja – Wikipedia"
source: "https://sv.wikipedia.org/wiki/Markovkedja"
date: "2004-11-18T09:23:07.000Z"
extraction: "dom"
---

En markovkedja är en stokastisk process där sannolikheten för varje händelse
enbart beror på det tillstånd som uppnåddes i den föregående händelsen.[^1]

[^1]: Markov, A. A. (1906). Utvidgning av de stora talens lag till storheter
      som beror av varandra.

Så sparar du en webbsida som Markdown i Chrome

Installera tillägget, sedan tre steg. Ingenting behöver ställas in först: som standard öppnar ett klick en förhandsvisning där Markdown-texten redan är klar att kopiera eller spara som fil. Senare kan du låta ett enda klick skriva anteckningen rakt in i en mapp eller i ditt vault utan förhandsvisning.

  1. Fäst ikonen. Öppna pusselbitsmenyn bredvid adressfältet och fäst Clean Web Clipper i verktygsfältet.
  2. Öppna artikeln du vill behålla – själva artikeln, inte en sida med länkar till den.
  3. Klicka på ikonen. Markdown-texten visas i förhandsvisningen: kopiera den eller spara .md-filen.

Var det sparas

Vad klicket på ikonen gör bestämmer du. Behåll förhandsvisningen, eller låt ett klick lägga anteckningen i vaultet utan att öppna någonting alls.

Inställningarna i Clean Web Clipper: att välja vad klicket på ikonen gör
Inställningarna avgör vad ett klick gör – förhandsvisning, urklipp, fil, mapp eller rakt in i vaultet.

Ärligt om källan

Varje anteckning märks med ett extraction-fält. dom betyder att texten kom från det webbläsaren faktiskt renderade. jsonld-articlebody betyder att sidan aldrig renderade färdigt och att brödtexten fick läsas ur sidans egna strukturerade data. Och när det inte finns någon artikel alls på sidan – en butik, ett flöde, ett sökresultat – säger tillägget det i stället för att kasta trehundra länkar på dig.

Skärmen Nytta i Clean Web Clipper: klipp, sparad tid, favoritsajter och sidor som misslyckades
Nytta: hur många klipp som fungerade, hur mycket tid de sparade och varje sida som inte gjorde det.
Clean Web Clipper vägrar en sida utan artikel och erbjuder att skicka dess adress
Ingen artikel på sidan – en ärlig vägran i stället för trehundra menylänkar.
Startsidan för Clean Web Clipper vid första körningen, med tre steg för att komma igång
Första körningen: fäst ikonen, klipp en sida, välj vad klicket gör.

Vad det inte gör

Femton sätt att använda det

UtvecklareKodblock behåller sin språkmärkning, så inklistrad dokumentation färgläggs direkt.

Clean Web Clipper läser kodblockets språk ur sidan själv – ur klassen på blocket, ur föräldraelementet eller ur färgläggarens egen uppmärkning – och skriver in det i Markdown-texten. På ett tekniskt korpus överlevde märkningen i 73 av 156 kodblock, mot 20 och 0 för de två jämförda motorerna.

  • Ett block kommer ut som ```js och inte naket – färgläggningen fungerar i Obsidian, VS Code och på GitHub i samma sekund du klistrar in
  • Märkningen kommer från sidan själv: klassen färgläggaren lämnat efter sig, inte en gissning utifrån koden
  • Tabeller med ett kodexempel i en cell klappar inte ihop till en enda rad
Läs mer
Obsidian-användarePeka ut en mapp i vaultet en gång, så hamnar varje sparad sida där som .md-fil.

Tillägget skriver anteckningen själv, till den mapp du pekar ut, via webbläsarens File System Access API. Ingen community-plugin är inblandad, inget lokalt REST API och ingen obsidian://-länk, och Obsidian behöver inte vara igång: filen ligger där nästa gång du öppnar vaultet.

  • Ingen plugin, ingen lokal server, inga obsidian://-länkar – tillägget skriver filen själv
  • Obsidian behöver inte vara öppet; filen finns där nästa gång du öppnar vaultet
  • YAML-frontmatter med title, source, author, published och extraction, och du väljer vilka fält som stannar
Läs mer
AI och språkmodellerUpprepad navigering är bortkastad kontext. Den försvinner innan texten når modellen.

En webbsida du klistrar in i en modell består till en dryg del av navigering, och varje dubblerad menyrad räknas som kontext. På ett korpus om 109 sidor (den direkta jämförelsen) lämnade Clean Web Clipper 102 dubblerade navigeringsrader, där tre andra motorer lämnade 282, 478 och 491. Kvar blir texten, med källadressen och datumet i frontmatter.

  • Ungefär fyra gånger mindre dubblerad navigering än genomsnittet för de jämförda motorerna
  • Inga kvarlämnade HTML-taggar i någon extraherad artikel, över 512 testade sidor – ingen uppmärkning att läsa sig förbi
  • Frontmatter ger modellen källadressen och publiceringsdatumet uttryckligen
Läs mer
ForskareLäser citation_date, standarden hos arXiv, PubMed och IEEE, och lägger fotnoterna sist.

Datumet kommer ur sidans metadata och inte ur en gissning på texten: citation_date, JSON-LD datePublished, article:published_time, time[datetime] och Unix-stämplar läses i den ordningen. Bär sidan inget datum lämnas fältet tomt. Referenslänkar blir [^1]-fotnoter med sina definitioner sist i anteckningen.

  • Läser citation_date och citation_publication_date – metataggarna som arXiv, PubMed och IEEE skickar med
  • Dessutom JSON-LD datePublished, article:published_time, time[datetime] och Unix-stämplar
  • Inget datum på sidan betyder ett tomt fält, aldrig dagens datum
Läs mer
StudenterFöreläsningar, kapitel och uppslagssidor blir vanliga Markdown-filer på din egen disk.

Kursmaterial försvinner när terminen är slut: lärplattformen stängs, länken ruttnar och pdf-filen ligger bakom en inloggning du inte längre har. En sparad sida är ren text med källan kvar, och den öppnas i vilken redigerare som helst om tio år. Markerar du något på sidan sparas bara markeringen.

  • Markera ett stycke så sparas bara markeringen – praktiskt när du vill citera en definition
  • Varje anteckning bär källadressen, så det kostar ingen sökning att hänvisa till den senare
  • Publiceringsdatumet läses där sidan bär ett, och lämnas annars tomt
Läs mer
SkribenterVarje sparad sida behåller källadress, författare och publiceringsdatum, så att ett citat behåller sitt ursprung.

Det du sparar som skärmbild eller bokmärke är oanvändbart just i det ögonblick du ska ange källan. En Markdown-fil håller rubriken, författaren, datumet och adressen i samma fil som texten, där en faktagranskning kan nå dem.

  • title, author, date och source i frontmatter i varje anteckning, så att källangivelsen följer texten.
  • Författarfältet filtreras: avsnittsrubriker, tidningsnamn och knapptexter tas inte för bylines.
  • Bara artikeltexten: nyhetsbrevsrutor, delningsrader och ”Läs också”-listor når aldrig anteckningen.
Läs mer
JournalisterTexten som du läste den, med publiceringsdatum och adress, i en fil på din egen disk.

Sidor skrivs om och plockas ned. Ett klipp rymmer hela texten, källadressen och publiceringsdatumet som sidan själv angav, i en vanlig fil du behåller – inte i en tjänst som kan läggas ned, ändra sina villkor eller i tysthet tappa underlaget.

  • Publiceringsdatumet läses ur sidans egna metadata – JSON-LD, article:published_time, time[datetime] – inte ur brödtexten.
  • Källadressen ligger i frontmatter i varje anteckning.
  • Hela artikeltexten utan navigering och puffar som byts ut mellan besöken.
Läs mer
Juridiskt arbeteTexten som den är publicerad, med källadress och datum, i en fil du själv råder över.

Föreskrifter, användarvillkor och officiell vägledning ändras utan förvarning. En Markdown-kopia med adressen den kom från och datumet sidan angav visar vad texten sa den dag du läste den.

  • Ordagrann text – ingenting i artikeltexten sammanfattas, skrivs om eller kastas om.
  • Källadress och sidans angivna publiceringsdatum i frontmatter i varje anteckning.
  • Tabeller över avgifter, tidsfrister och beloppsgränser serialiseras av tillägget självt: 12 av 15 behölls på det tekniska korpuset, mot 7 för var och en av de jämförda motorerna.
Läs mer
AnalytikerEn cell med kod, en lista eller en länk bryter inte längre raden: 12 av 15 tabeller behållna.

Generiska omvandlare från HTML till Markdown går sönder på de tabeller som betyder något: de med en lista, en länk eller ett kodexempel inne i en cell. Clean Web Clipper serialiserar tabellen själv och plattar ut cellinnehållet i stället för att tappa raden.

  • En GFM-tabellserialisering skriven för just det här, inte en generisk omvandlarplugin som skruvats fast.
  • 12 tabeller av 15 behållna på det tekniska korpuset, mot 7 för var och en av de jämförda motorerna.
  • Ojämna tvåkolumnstabeller blir rader med fetstilt nyckel och värde i stället för ett trasigt rutnät.
Läs mer
LärareMaterialet utan sajten runt omkring: inga menyer, ingen samtyckesruta, ingen reklam på det utskrivna bladet.

En sida som skrivs ut direkt ur webbläsaren tar med sig menyer, samtyckesruta och reklam till elevunderlaget. Ett klipp tar med texten, med källadressen kvar i filen, så att källhänvisningen inte kostar något extra arbete.

  • En utskriftsknapp som skriver ut klippet, inte sidan runt omkring.
  • Läsläget visar resultatet som vanlig text, utan Markdown-tecken, innan du skriver ut eller sparar.
  • Markera en övning eller en definition och klipp bara den.
Läs mer
ÖversättareNavigering, banners och upprepade menyer når aldrig segmentlistan.

Källtext som klistras in från en webbsida bär med sig navigeringen, och varje menypost blir ett segment du måste hoppa över. Clean Web Clipper klipper bort det före exporten: på ett korpus om 109 sidor återstod 102 dubblerade navigeringsrader, mot 282, 478 och 491 hos de tre andra motorerna. Det du importerar är brödtext.

  • Menyer, sidnumrering, kakbanners och ”Läs också”-block klipps bort före exporten
  • Dubblerade navigeringsrader ungefär fyra gånger färre än hos de jämförda motorerna
  • Vanlig Markdown importeras i alla större CAT-verktyg
Läs mer
ProduktcheferÄndringsloggar, dokumentation och release notes som daterade, sökbara anteckningar.

Omvärldsbevakning som samlas som bokmärken förfaller till en lista länkar du inte kan söka i. Sparad som Markdown blir den ett korpus du kan söka i, jämföra och citera i ett beslutsunderlag – med sidans eget publiceringsdatum, så att en post i en ändringslogg behåller sin verkliga tidpunkt.

  • Publiceringsdatumet läses ur sidan, så en post i en ändringslogg behåller sin verkliga tidpunkt
  • Med regler per webbplats hamnar varje konkurrent i sin egen mapp av sig själv
  • Tabeller över planer, gränser och funktionsjämförelser överlever hela
Läs mer
TeknikinformatörerStruktur, kodblock och tabeller följer med; webbplatsens inredning gör det inte.

Att migrera dokumentation brukar innebära att man omvandlar HTML och sedan lägger längre tid på att ta bort det omvandlaren behöll. Borttagningen är det Clean Web Clipper är byggt kring, och den är också den del som är testad: inga kvarlämnade HTML-taggar i någon extraherad artikel, över 512 testade sidor, och språkmärkningar som sitter kvar på kodblocken.

  • Rubriker, listor, tabeller, kodblock och fotnoter blir alla vanlig Markdown
  • Språkmärkningen sitter kvar på kodblocken – 73 av 156 på det tekniska korpuset, mot 20 och 0
  • Inga kvarlämnade HTML-taggar i någon extraherad artikel, över 512 testade sidor
Läs mer
Personligt arkivVanliga Markdown-filer på din egen disk. Inget konto, ingen tjänst som kan läggas ned.

Bokmärken pekar på sidor som ändras eller försvinner. En sparad kopia är själva texten, i ren text med YAML-frontmatter, lagrad där du bestämmer. Sidans text lämnar aldrig webbläsaren och sparandet hänger inte på någon tjänst, så det finns inget konto som kan gå ut och ingen tjänst som kan dra in din åtkomst.

  • Beständigt öppet format: ren text med YAML-frontmatter, läsbar i vilken redigerare som helst
  • Inget konto – sidans text lämnar aldrig webbläsaren
  • Publiceringsdatum och källadress fångas tillsammans med texten
Läs mer
Läsa utan brusEtt läsläge som visar texten utan menyer, utan banners och utan Markdown-tecken.

Sidinredning är inte bara visuellt stök: det är text som en skärmläsare läser upp och en läsare måste hoppa över. Fönstret visar artikeln för sig själv, i webbläsarens ljusa eller mörka tema, och inga skript från sidan kör med. Det du sparar är ren text som vilket hjälpmedel som helst klarar.

  • Visar den sparade texten som vanlig text, utan Markdown-tecken, med rubriker, tabeller och fungerande länkar
  • Följer webbläsarens inställning för ljust och mörkt
  • Förstoras till ett fönster på tre fjärdedelar av skärmen, så att sidan bakom syns kvar
Läs mer
Lägg till i Chrome – gratisHelt gratis, inget konto, inga gränser. Extraheringen fungerar offline; användningshändelser skickas när du är uppkopplad, och en enda knapp stoppar dem.For Chrome on a computer

Frågor

Vilka webbläsare fungerar det i?
Chrome och andra Chromium-webbläsare: Edge, Brave, Vivaldi, Opera. Det är ett Manifest V3-tillägg, och den enda adress det får tala med är vår egen statistikadress – aldrig webbplatserna du läser.
Är det gratis?
Ja, helt och hållet. Allt som beskrivs på den här sajten finns i det kostnadsfria tillägget: sparande utan sidgräns, Obsidian-vaultet, regler per webbplats, fotnoter, tabeller, språkmärkta kodblock och läsläget. Gränssnittet finns på 19 språk och följer inställningen i din webbläsare. Det finns ingen betalversion, inget konto och ingen registrering.
Måste Obsidian vara igång för att spara till vaultet?
Nej. Clean Web Clipper skriver filen direkt till en mapp du gett åtkomst till, via webbläsarens File System Access API. Obsidian plockar upp filen nästa gång det tittar i vaultet.
Vad händer på en sida som inte är en artikel?
Tillägget säger ifrån. På butiker, flöden och sökresultat finns ingen artikel att extrahera, och sparandet markeras som ”ingen artikel” i stället för att ge dig en sida full av länkar.
Skickar Clean Web Clipper mina sidor någonstans?
Dina sidor, nej. Extrahering och omvandling sker helt inne i din webbläsare: kopian går till urklipp och filen till din disk, och ingen sidtext eller titel lämnar datorn. Fem saker går däremot till vår egen statistikserver: adressen till en sida där ingen artikel hittades, bara domänen för ett lyckat klipp, namnet på den skärm i tillägget du öppnade, vilken åtgärd du valde för ett klipp – kopiera, fil, mapp, Obsidian-vault, skriv ut eller AI-chatt – utan sidans adress, och ett slumpmässigt installationsnummer som knyter ihop händelserna. Adresser på ett lokalt nätverk skickas aldrig. Servern noterar också en ungefärlig plats – land, region och stad – härledd ur IP-adressen; själva adressen sparas inte. Inget av det går till tredje part, och en enda knapp i inställningarna stoppar alltihop och raderar numret. Tillägget ber inte om någon behörighet på webbplatserna du läser, så det kan inte titta på en sida du inte har klickat på.