Clean Clipper Přidat do Chromu – zdarma

Pod kapotou

Jak to funguje a kde to končí

Nic z toho není kouzlo a nic z toho nevolá server. Celá cesta proběhne ve stránce, na kterou se díváte, za pár desítek milisekund.

Najít článek

Nejdřív rozšíření hledá běžné kontejnery, ve kterých článek obvykle bydlí. Když takový kontejner není – a na spoustě skutečných webů není – přejde na měření hustoty textu: který blok obsahuje nejvíc odstavcového textu, který neleží uvnitř odkazu. Vyhraje nejužší blok, ve kterém je pořád skoro všechen ten text.

Blok, jehož text tvoří převážně popisky odkazů, je menu nebo výpis, ne článek, a vypadne – ledaže by obsahoval víc než zhruba 1200 znaků skutečného textu, protože dlouhé články oprávněně obsahují spoustu odkazů.

Odříznout výbavu stránky

Pak jdou pryč známé nesouvisející prvky: navigace, bannery, lišty pro sdílení, cookie hlášky, stránkování, bloky „čtěte dále“ a pásy log. Opakované řádky se odstraňují, protože navigace zdvojená v každé sekci je největší jediný zdroj šumu v uložené stránce.

co si nechají jiné clippery

[Přejít na obsah](#main) [Přihlásit se](/login) [Registrovat](/registrace)
[Úvod](/) [Zprávy](/zpravy) [Sport](/sport) [Kultura](/kultura) [Více](/vice)

Používáme cookies a podobné technologie, abychom vám web přizpůsobili.
[Přijmout vše] [Nastavit předvolby]

# Článek, kvůli kterému jste přišli

První odstavec vlastního textu.

<div class="promo-inline">

## Čtěte dále
[Jiný titulek](/a) [Ještě jeden titulek](/b) [A třetí](/c)

co skončí v poznámce

# Článek, kvůli kterému jste přišli

První odstavec vlastního textu.

Převést

Tabulky si rozšíření serializuje samo místo obecného pluginu, protože obecné převodníky se lámou na buňce se seznamem nebo blokem kódu. Bloky kódu si berou jazyk ze značek samotné stránky. Odkazy na reference se posbírají do poznámek pod čarou ještě předtím, než sanitizace odstraní identifikátory, na kterých stojí – na pořadí záleží a špatné pořadí tiše ztratí každou poznámku.

Kde to končí

Na e-shopu, ve výpisu nebo ve výsledcích hledání žádný článek není. Rozšíření zkontroluje hotový Markdown: pokud víc než čtvrtina z něj leží uvnitř popisků odkazů, ohlásí „tady článek není“, místo aby vám podalo tři sta odkazů. To odmítnutí je záměrné a je důvod, proč jsou počty znaků tady nižší než u nástrojů, které vždycky něco vrátí.

Co nedělá

Otázky

Jak dlouho uložení trvá?
U běžného článku desítky milisekund; hodně dlouhá stránka se stovkami poznámek pár set. Čas se ukazuje v rohu okna.
Funguje to na jednostránkových aplikacích?
Ano. Rozšíření čte DOM až po vykreslení, takže dokumentaci postavenou v JavaScriptu uloží tak, jak ji vidíte.
Co je režim extrakce jsonld-articlebody?
Některé stránky vozí text článku ve strukturovaných datech, ale nikdy ho nedovykreslí. Když strukturovaná data obsahují podstatně víc textu než DOM, rozšíření použije je a zaznamená to.