Clean Clipper Додати в Chrome – безкоштовно

Кому це

Статті зі справжньою датою публікації

Збережена стаття без дати – це посилання, яке потім доведеться відновлювати руками. Clean Clipper бере дату з метаданих самої сторінки, а не вгадує її з тексту; якщо на сторінці дати немає, поле лишається порожнім, а не заповнюється сьогоднішнім числом.

Чому бібліографія розсипається

Через півроку ви відкриваєте теку з матеріалами й бачите сорок нотаток, у яких дата – це день, коли ви натиснули «зберегти». Яка з цих статей вийшла раніше, а яка відповідає на попередню, встановити вже неможливо. Доводиться відкривати кожне посилання наново, і частина з них веде на сторінку, якої вже немає.

Виноски страждають окремо. У більшості конвертерів посилання-примітки перетворюються на мертві якорі на сторінку, яку ви закрили, а сам перелік джерел лишається внизу нерозбірливою купою. Прізвище автора при цьому нерідко підмінюється назвою розділу або підписом кнопки – і ви цього не помічаєте, поки не берете цитату в текст.

Третє – сама стаття не стоїть на місці. Препринт живе в трьох редакціях, і адреса віддає останню; ви цитуєте абзац із першої, а рецензент відкриває третю, де цього абзацу немає. Портал видавця тим часом перебудовується, і посилання на розділ веде на нову верстку. Збережений файл фіксує текст із датою, яку сторінка оголосила у власних метаданих, і поле extraction каже, звідки цей текст узято – із видимої сторінки чи зі структурованих даних.

Що приїжджає в нотатку

Дату взято з citation_date, а не з текстуnbuv.gov.ua/UJRN/vntu_2021_3_7
---
title: "Моделювання дифузії домішок у багатошарових структурах"
source: "http://nbuv.gov.ua/UJRN/vntu_2021_3_7"
author: "Коваленко О. В."
date: "2021-09-30T00:00:00.000Z"
extraction: "dom"
---

## Постановка задачі

Розглянуто крайову задачу для рівняння дифузії з розривними коефіцієнтами
на межі шарів[^2].

[^2]: Тихонов А. М., Самарський А. А. Рівняння математичної фізики. – 1977. – С. 214.

Налаштувати під роботу з джерелами

Дослідникові важливе інше, ніж читачеві: повний frontmatter, дата в імені файлу і можливість звірити метадані до того, як нотатка ляже в теку.

  1. Оберіть у параметрах теку – краще одразу всередині vault, наприклад Research/Sources. Нотатки й джерела в одному місці позбавляють вас другого сховища, яке доведеться синхронізувати окремо.
  2. Лишіть дію кліку по іконці на «показати перегляд». Це єдина аудиторія, якій вікно потрібне: у ньому видно, яку дату й якого автора знайдено, і помилку краще побачити до запису, а не через півроку.
  3. Задайте шаблон імені {date}-{title}. Тека сама шикується хронологічно, і послідовність «стаття – відповідь на неї – заперечення» читається зі списку файлів без жодної бази даних.
  4. Увімкніть у frontmatter усі поля, зокрема author і extraction. Перше потрібне для посилання, друге каже, чи текст узято з видимої сторінки, чи зі структурованих даних.
  5. Додайте правило за сайтом для препринтів: arxiv.org → підтека preprints. Не рецензований текст і опублікована стаття не мають лежати в одній теці – переплутати їх легко саме через півроку.
  6. Зображенням лишіть «посиланнями». Графік у статті часто і є результатом; посилання хоча б покаже, чого бракує, коли сайт закриється.
  7. Після першого збереження відкрийте файл і звірте date з датою на сторінці. Якщо поле порожнє, дату варто дописати руками одразу – потім джерело цієї дати доведеться шукати наново.

Готові налаштування дослідникові

Шість значень, які варто змінити з початкових, і причина кожного – саме для роботи з джерелами, а не для читання взагалі.

НалаштуванняЗначенняЧому саме так
Тека`Research/Sources` усередині vaultДжерела лежать поруч із нотатками, і синхронізувати треба одне сховище, а не два
Клік по іконціПоказати переглядДату й автора краще звірити до запису: через півроку помилку вже не відстежити
Шаблон імені`{date}-{title}`Тека шикується хронологічно, і послідовність публікацій видно зі списку файлів
FrontmatterУсі поля, зокрема `author` і `extraction``author` іде в посилання, `extraction` каже, з якого шляху взято текст
ЗображенняЛишати посиланнямиГрафік у статті часто і є результатом; посилання показує принаймні, чого бракує
Правило за сайтом`arxiv.org` → підтека `preprints`Не рецензований текст і опубліковану статтю плутають саме тоді, коли вони в одній теці
Скорочення`Alt+Shift+M`Читання й збереження не розриваються на два різні заняття
Сторінка дати не оголосила – поле лишилося порожнімсторінка розділу на порталі видавця
---
title: "Метод скінченних елементів у задачах теплопровідності"
source: "https://example.org/chapters/fem-heat"
author: "Мельник І. П."
date: ""
extraction: "dom"
---

## Вступ

Порожнє поле `date` означає одне: у розмітці сторінки дати немає –
ані в `citation_date`, ані в структурованих даних, ані в `time[datetime]`.
Сьогоднішнє число туди не підставляється: хибна дата в бібліографії
гірша за відсутню, бо її не видно.

Три робочі ситуації

Препринт, який устиг змінитися

Ви цитуєте абзац із препринту й зберігаєте сторінку. Файл лягає в preprints як 2025-11-04-...md, date містить дату тієї редакції, source – адресу з номером версії. Через рік автори виклали третю редакцію, і адреса без номера віддає вже її.

Ваш текст спирається на абзац, якого в третій редакції немає. Збережений файл показує це за секунду: дата в шапці не збігається з датою живої сторінки, а сам абзац лежить перед вами. Без файлу лишалася б суперечка про те, що там було написано.

Матеріали, які видно тільки з університету

Додатки до статті відкриваються за інституційним доступом. Розширення читає ту сторінку, яку браузер уже намалював у вашій сесії, тож збереження нічим не відрізняється від публічної. Мережевих запитів воно не робить взагалі – сторінка не йде нікуди, крім вашого диска.

Що не збережеться – це PDF-файл додатка: бінарних файлів розширення не завантажує. Зате HTML-версія на порталах видавців зазвичай багатша на метадані, ніж сам PDF, і citation_date частіше є саме в ній.

Хронологія суперечки в одній теці

Тема розвивалася три роки: стаття, відповідь на неї, заперечення, огляд. Ви зберігали кожен матеріал у міру читання, і всі вони мають імена з датою публікації, а не з датою збереження.

Тека, відсортована за іменем, і є хронологією. Вона показує, що заперечення вийшло раніше за огляд, який на нього не посилається, – а це вже змістовне спостереження, а не бібліографічна дрібниця.

Проти звичних способів

Дослідники фіксують джерела всіма цими способами, часто кількома одразу. Третя колонка каже, чого кожен коштує, і про нас теж.

СпосібЩо виходитьЧого це коштує
Закладка на статтюАдреса, миттєвоВеде на сьогоднішню редакцію; після перебудови порталу – у нікуди
Копіювання в документТекст, який можна цитуватиДату й автора дописуєте руками, а виноски перетворюються на мертві якорі
Друк у PDFВерстка сторінки цілкомНе шукається пошуком по теці, не порівнюється; метадані лишаються в зображенні сторінки
Менеджер бібліографіїОформлений запис і поляТексту статті не зберігає – цитувати доводиться з живої сторінки
Скріншот розділуТочна картинкаНе шукається, не цитується, і половина сторінки не влазить
Clean ClipperТекст із датою, автором і адресою у frontmatterЗаписів за ДСТУ чи APA не будує, PDF не завантажує, відкликань не перевіряє

Коли метадані підвели

Чому поле date порожнє?

Бо сторінка ніде не оголосила дати. Розширення перевіряє citation_date, citation_publication_date, datePublished у структурованих даних, article:published_time, time[datetime] і мітки Unix – і не вигадує дати, коли жодного з них немає. Порожнє поле видно одразу, і ви допишете дату самі; підставлене сьогоднішнє число виглядало б правдою й тихо зіпсувало б бібліографію.

Чому автора не знайдено?

Розширення бере автора зі структурованих даних і підписів під заголовком, а очевидно хибні збіги відсіює – краще порожньо, ніж «Читайте також» у полі author. Ця обережність має ціну: на замірі зі 109 сторінок знайдено 20 авторів проти 28 у найкращого з порівнюваних рушіїв. Тут ми позаду, і це видно в самому вимірюванні.

Чому стаття, відкрита як PDF, не збереглася?

Бо в PDF немає DOM: браузер показує його вбудованим переглядачем, а не як сторінку. Розширення працює з відмальованим HTML, тож зберігати треба HTML-версію статті. На порталах видавців вона зазвичай є поруч і містить більше метаданих, ніж сам файл.

Чому виноски ведуть у нікуди?

Якщо в нотатці виноска не відкривається, майже завжди йдеться про посилання на якір усередині живої сторінки, а не про перелік джерел. Перелік джерел переїжджає визначеннями [^1] у кінець файлу й працює всередині нотатки. Внутрішні якорі сторінки лишаються звичайними посиланнями на неї – вони й мають вести на оригінал.

Чого воно не робить

Розширення не оформлює бібліографію: воно не будує запис за ДСТУ чи APA і не працює із BibTeX. Воно не завантажує PDF – зберігається та сторінка, яку відмалював браузер, а не файл за посиланням. Метаданих, яких на сторінці немає, воно не вигадує: ані DOI, ані назви журналу, ані номера випуску. І воно не перевіряє, чи стаття відкликана, – це лишається на вас.

Додати в Chrome – безкоштовноБезкоштовно повністю, без акаунта.

Питання

Що буде, якщо на сторінці немає дати публікації?
Поле лишиться порожнім. Записати туди день, коли ви випадково зберегли сторінку, гірше, ніж лишити порожнечу: це тихо перетворюється на хибні дані у ваших нотатках.
Чи працюють виноски після збереження?
Так – вони стають звичайними виносками Markdown, які Obsidian і більшість переглядачів перетворюють на робочі посилання всередині нотатки.
Чи можна зберегти статтю за інституційним логіном?
Так, бо розширення читає сторінку, яку ваш браузер уже відмалював. Якщо ви її бачите – її можна зберегти.
Чи зберігається PDF статті?
Ні. Бінарних файлів розширення не завантажує взагалі. Зберігається HTML-версія статті, яка на порталах видавців зазвичай повніша за метаданими.
Наскільки надійно визначається автор?
Автор береться зі структурованих даних і підписів під заголовком, а очевидно хибні збіги відсіюються. На першому корпусі зі 109 сторінок знайдено 20 авторів проти 28 у найкращого з порівнюваних рушіїв – тут Clean Clipper позаду, і це видно в замірі.
Чи будує воно бібліографічний запис за ДСТУ або APA?
Ні. У нотатку лягають сирі поля – заголовок, автор, дата, адреса, – а форматування запису лишається редакторові чи менеджеру бібліографії. Зате з цих полів запис складається без відкривання статті наново.
Чи можна працювати з BibTeX?
Прямо – ні, експорту в BibTeX немає. Але поля frontmatter це звичайний YAML, тож із теки нотаток запис збирається простим скриптом; жодного власного формату розширення не вигадує.
Чи перевіряє воно, чи статтю відкликано?
Ні, і не вдає, що перевіряє. Позначку про відкликання шукайте на самій сторінці або в реєстрі відкликань – збережений файл фіксує лише те, що сторінка казала в момент кліку.
Що означає `extraction: "dom"` у моїх файлах?
Що текст узято з видимої сторінки – з того, що браузер відмалював. Альтернативне значення jsonld-articlebody означає, що видимого тексту не було й тіло взято зі структурованих даних; ці дві копії подекуди розходяться, тож значення записується, а не ховається.
Чи знайде воно дату на українських наукових сайтах?
Іноді. Українських сторінок у нашому вимірюванні було тринадцять – надто мало, щоб робити з цього статистику. Практика простіша: там, де сайт віддає citation_date, дата знаходиться; там, де дата є тільки словами в тексті, поле лишиться порожнім.