Rozszerzenie do Chrome
Zapisz stronę jako Markdown, którego nie trzeba sprzątać
Kliknij ikonę i klip już jest – Clean Clipper zapisuje stronę jako Markdown razem z tytułem, autorem, datą publikacji i adresem źródła we frontmatterze, a treść zostaje bez nawigacji. Wszystko dzieje się w Twojej przeglądarce: bez konta, bez serwera, bez telemetrii.

Problemem nigdy nie jest konwersja. Problemem jest to, co przychodzi razem z nią.
Każdy clipper zamienia HTML na Markdown. Potem otwierasz notatkę i znajdujesz w niej pasek o ciasteczkach, boczne menu, listę „Czytaj także” i tabelę, która rozsypała się po drodze. Clean Clipper jest zbudowany dokładnie wokół usuwania tego, a usuwanie zostało zmierzone, a nie zadeklarowane.
co zostawiają inne clippery
[Przejdź do treści](#main) [Zaloguj się](/login) [Załóż konto](/rejestracja) [Start](/) [Wiadomości](/wiadomosci) [Sport](/sport) [Kultura](/kultura) [Więcej](/wiecej) Używamy plików cookie i podobnych technologii, aby ulepszać nasze usługi. [Akceptuj wszystkie] [Ustawienia] # Artykuł, po który przyszedłeś Właściwy pierwszy akapit tekstu. <div class="promo-inline"> ## Czytaj także [Inny nagłówek](/a) [Jeszcze jeden](/b) [I trzeci](/c)
co ląduje w notatce
# Artykuł, po który przyszedłeś Właściwy pierwszy akapit tekstu.
Co sprawia, że wynik jest czysty
- Kod zachowuje język. Blok wychodzi z etykietą
js, a nie goły, więc kolorowanie składni działa od razu po wklejeniu. - Tabele zostają całe. Komórka z kodem albo listą nie rozrywa już wiersza.
- Przypisy naprawdę działają. Odnośniki do bibliografii stają się
[^1]z definicjami na końcu notatki, a nie martwymi kotwicami. - Data jest odczytana, a nie zgadnięta. JSON-LD,
article:published_time,citation_date(standard arXiv, PubMed i IEEE),time[datetime], znaczniki uniksowe. Brak daty na stronie oznacza puste pole, nigdy dzisiejszą datę. - Menu, banery i „Czytaj także” lecą precz. Paski logotypów, paginacja i nawigacja powtórzona w każdej sekcji nigdy nie docierają do notatki.
- Ani jednego resztkowego znacznika. Żadnego
divczytablew środku tekstu.
---
title: "Łańcuch Markowa – Wikipedia"
source: "https://pl.wikipedia.org/wiki/Łańcuch_Markowa"
date: "2004-03-19T18:22:07.000Z"
extraction: "dom"
---
Łańcuch Markowa to ciąg zdarzeń losowych, w którym prawdopodobieństwo
każdego zdarzenia zależy wyłącznie od stanu osiągniętego w zdarzeniu
poprzednim.[^1]
[^1]: Plucińska, A.; Pluciński, E. (2000). Probabilistyka. Warszawa:
Wydawnictwa Naukowo-Techniczne, s. 289–312.Zmierzone na 512 stronach najczęściej odwiedzanych serwisów
Dwa przebiegi. Pierwszy wziął 109 stron ze stu najczęściej odwiedzanych serwisów świata i Rosji i porównał wynik z trzema innymi silnikami ekstrakcji. Drugi wziął po pięćdziesiąt najpopularniejszych serwisów w każdym z dwunastu krajów Europy – kolejne 403 strony, każda zebrana w języku danego kraju.
Gdzie zapisuje
- Skopiować Markdown do schowka
- Pobrać plik
.md - Zapisać do wybranego przez Ciebie folderu na dysku
- Zapisać prosto do vaultu Obsidian – bez wtyczki, bez lokalnego REST API, bez schematu URI; plik po prostu się pojawia
Reakcję na kliknięcie ikony ustawiasz sam. Możesz zostawić okno podglądu albo sprawić, żeby jedno kliknięcie odkładało notatkę do vaultu i nie otwierało zupełnie nic.

Uczciwie o źródle
Każda notatka dostaje pole extraction. dom znaczy, że tekst pochodzi z tego, co przeglądarka faktycznie wyrenderowała. jsonld-articlebody znaczy, że strona nigdy nie dokończyła renderowania i treść trzeba było odczytać z jej własnych danych strukturalnych. A kiedy artykułu na stronie nie ma wcale – sklep, lista wpisów, wyniki wyszukiwania – rozszerzenie tak właśnie mówi, zamiast wysypać na Ciebie trzysta odnośników.
Piętnaście sposobów, na jakie się go używa
ProgramiściOgrodzenie kodu zachowuje etykietę języka – kolorowanie działa od razu po wklejeniu.
Clean Clipper odczytuje język bloku kodu z samej strony – z klasy przy ogrodzeniu, z elementu nadrzędnego, ze znaczników kolorowania – i wpisuje go za backticki. Na korpusie technicznym metka przetrwała w 73 ogrodzeniach na 156, wobec 20 i 0 w dwóch porównywanych silnikach. Reszta strony trafia do notatki jako zwykły Markdown, bez kolumny bocznej.
- Ogrodzenie wychodzi jako ```js, a nie gołe – kolorowanie działa w Obsidianie, VS Code i na GitHubie od razu po wklejeniu
- Język jest czytany ze strony: z klasy przy ogrodzeniu, z elementu nadrzędnego, ze znaczników kolorowania – nigdy zgadywany z treści kodu
- Tabela parametrów z kodem w komórce zachowuje swoje wiersze, zamiast zwinąć się do jednej linii
ObsidianNotatka ląduje w wybranym folderze vaulta z frontmatterem – bez schowka i bez wtyczek.
Clean Clipper zapisuje plik .md wprost do folderu, który wskażesz – także do vaulta Obsidiana – z frontmatterem title, source i published na górze. Nie trzeba wtyczki, serwera lokalnego ani przechodzenia przez schowek: notatka pojawia się w vaultcie i Obsidian podnosi ją przy najbliższym odświeżeniu.
- Plik
.mdląduje bezpośrednio w folderze vaulta, który wskażesz – bez wtyczki, bez serwera lokalnego, bez przechodzenia przez schowek - Frontmatter z
title,source,publishediextractionstoi na górze i jest gotowy dla Dataview oraz dla właściwości Obsidiana - Wzorzec nazwy pliku układasz sam:
{date}-{title},{domain}-{title}albo sam{title}