Clean Clipper Lägg till i Chrome – gratis

Under huven

Så fungerar det, och var det slutar

Ingenting här är magi och ingenting ringer en server. Hela kedjan kör i sidan du tittar på, på några tiotals millisekunder.

Att hitta artikeln

Först letar tillägget efter de självklara behållarna som en artikel brukar ligga i. När det inte finns någon sådan – och på många riktiga webbplatser finns det inte – går det över till att mäta textdensitet: vilket block rymmer mest brödtext som inte sitter inuti en länk. Det smalaste block som ändå rymmer nästan all den texten vinner.

Ett block vars text mest består av länketiketter är en meny eller ett flöde, inte en artikel, och det förkastas – såvida det inte rymmer mer än ungefär 1200 tecken riktig text, eftersom långa artiklar med rätta innehåller många länkar.

Att klippa bort inredningen

Sedan åker de kända icke-innehållsdelarna ut: navigering, banners, delningsrader, kaknotiser, sidnumrering, ”Läs också”-flöden och logorader. Upprepade rader tas bort, för navigering som återkommer i varje avsnitt är den enskilt största bruskällan i en sparad sida.

vad andra clippers behåller

[Hoppa till innehållet](#main) [Logga in](/logga-in) [Bli medlem](/prenumerera)
[Start](/) [Nyheter](/nyheter) [Sport](/sport) [Kultur](/kultur) [Mer](/mer)

Vi använder kakor och liknande tekniker för att förbättra din upplevelse.
[Godkänn alla] [Hantera inställningar]

# Artikeln du kom för att läsa

Textens faktiska första stycke.

<div class="promo-inline">

## Läs också
[En annan rubrik](/a) [Ytterligare en](/b) [Och en tredje](/c)

vad som hamnar i anteckningen

# Artikeln du kom för att läsa

Textens faktiska första stycke.

Omvandlingen

Tabeller serialiseras av tillägget självt i stället för av en generisk plugin, eftersom generiska omvandlare går sönder på en cell som innehåller en lista eller ett kodblock. Kodblock hämtar språket ur sidans egen uppmärkning. Referenslänkar samlas ihop till Markdown-fotnoter innan saneringen tar bort de id:n de bygger på – ordningen spelar roll, och gör man fel försvinner varje fotnot utan ett ljud.

Var det slutar

På en butik, ett flöde eller ett sökresultat finns ingen artikel. Tillägget granskar den färdiga Markdown-texten: sitter mer än en fjärdedel av den inuti länketiketter rapporterar det ”ingen artikel” i stället för att räcka över trehundra länkar. Den vägran är medveten, och den är skälet till att teckenmängderna här är lägre än hos verktyg som alltid returnerar något.

Vad det inte gör

Frågor

Hur lång tid tar det att spara en sida?
Några tiotals millisekunder för en vanlig artikel; en mycket lång sida med hundratals fotnoter tar några hundra. Tiden visas i hörnet av fönstret.
Fungerar det på ensidesapplikationer?
Ja. Tillägget läser DOM efter rendering, så en dokumentationssajt byggd i JavaScript sparas precis som du ser den.
Vad är extraheringsläget jsonld-articlebody?
Vissa sidor levererar artikeltexten i sina strukturerade data men renderar den aldrig färdigt. När de strukturerade datan rymmer betydligt mer text än DOM använder tillägget den – och antecknar att det gjorde det.