Кому це
Статті зі справжньою датою публікації
Збережена стаття без дати – це посилання, яке потім доведеться відновлювати руками. Clean Clipper бере дату з метаданих самої сторінки, а не вгадує її з тексту; якщо на сторінці дати немає, поле лишається порожнім, а не заповнюється сьогоднішнім числом.
Чому бібліографія розсипається
Через півроку ви відкриваєте теку з матеріалами й бачите сорок нотаток, у яких дата – це день, коли ви натиснули «зберегти». Яка з цих статей вийшла раніше, а яка відповідає на попередню, встановити вже неможливо. Доводиться відкривати кожне посилання наново, і частина з них веде на сторінку, якої вже немає.
Виноски страждають окремо. У більшості конвертерів посилання-примітки перетворюються на мертві якорі на сторінку, яку ви закрили, а сам перелік джерел лишається внизу нерозбірливою купою. Прізвище автора при цьому нерідко підмінюється назвою розділу або підписом кнопки – і ви цього не помічаєте, поки не берете цитату в текст.
Третє – сама стаття не стоїть на місці. Препринт живе в трьох редакціях, і адреса віддає останню; ви цитуєте абзац із першої, а рецензент відкриває третю, де цього абзацу немає. Портал видавця тим часом перебудовується, і посилання на розділ веде на нову верстку. Збережений файл фіксує текст із датою, яку сторінка оголосила у власних метаданих, і поле extraction каже, звідки цей текст узято – із видимої сторінки чи зі структурованих даних.
Що приїжджає в нотатку
- Читає
citation_dateіcitation_publication_date– метатеги, які віддають arXiv, PubMed та IEEE - А також JSON-LD
datePublished,article:published_time,time[datetime]і мітки Unix - Порожня дата чесніша за вигадану: якщо сторінка мовчить, поле лишається порожнім
- Посилання-примітки стають виносками
[^1]з визначеннями в кінці нотатки - Автор фільтрується: заголовки розділів, назви видань і підписи кнопок у поле author не потрапляють
- Адреса джерела записується у frontmatter, тож на нотатку можна послатися саму собою
--- title: "Моделювання дифузії домішок у багатошарових структурах" source: "http://nbuv.gov.ua/UJRN/vntu_2021_3_7" author: "Коваленко О. В." date: "2021-09-30T00:00:00.000Z" extraction: "dom" --- ## Постановка задачі Розглянуто крайову задачу для рівняння дифузії з розривними коефіцієнтами на межі шарів[^2]. [^2]: Тихонов А. М., Самарський А. А. Рівняння математичної фізики. – 1977. – С. 214.
Налаштувати під роботу з джерелами
Дослідникові важливе інше, ніж читачеві: повний frontmatter, дата в імені файлу і можливість звірити метадані до того, як нотатка ляже в теку.
- Оберіть у параметрах теку – краще одразу всередині vault, наприклад
Research/Sources. Нотатки й джерела в одному місці позбавляють вас другого сховища, яке доведеться синхронізувати окремо. - Лишіть дію кліку по іконці на «показати перегляд». Це єдина аудиторія, якій вікно потрібне: у ньому видно, яку дату й якого автора знайдено, і помилку краще побачити до запису, а не через півроку.
- Задайте шаблон імені
{date}-{title}. Тека сама шикується хронологічно, і послідовність «стаття – відповідь на неї – заперечення» читається зі списку файлів без жодної бази даних. - Увімкніть у frontmatter усі поля, зокрема
authorіextraction. Перше потрібне для посилання, друге каже, чи текст узято з видимої сторінки, чи зі структурованих даних. - Додайте правило за сайтом для препринтів:
arxiv.org→ підтекаpreprints. Не рецензований текст і опублікована стаття не мають лежати в одній теці – переплутати їх легко саме через півроку. - Зображенням лишіть «посиланнями». Графік у статті часто і є результатом; посилання хоча б покаже, чого бракує, коли сайт закриється.
- Після першого збереження відкрийте файл і звірте
dateз датою на сторінці. Якщо поле порожнє, дату варто дописати руками одразу – потім джерело цієї дати доведеться шукати наново.
Готові налаштування дослідникові
Шість значень, які варто змінити з початкових, і причина кожного – саме для роботи з джерелами, а не для читання взагалі.
| Налаштування | Значення | Чому саме так |
|---|---|---|
| Тека | `Research/Sources` усередині vault | Джерела лежать поруч із нотатками, і синхронізувати треба одне сховище, а не два |
| Клік по іконці | Показати перегляд | Дату й автора краще звірити до запису: через півроку помилку вже не відстежити |
| Шаблон імені | `{date}-{title}` | Тека шикується хронологічно, і послідовність публікацій видно зі списку файлів |
| Frontmatter | Усі поля, зокрема `author` і `extraction` | `author` іде в посилання, `extraction` каже, з якого шляху взято текст |
| Зображення | Лишати посиланнями | Графік у статті часто і є результатом; посилання показує принаймні, чого бракує |
| Правило за сайтом | `arxiv.org` → підтека `preprints` | Не рецензований текст і опубліковану статтю плутають саме тоді, коли вони в одній теці |
| Скорочення | `Alt+Shift+M` | Читання й збереження не розриваються на два різні заняття |
--- title: "Метод скінченних елементів у задачах теплопровідності" source: "https://example.org/chapters/fem-heat" author: "Мельник І. П." date: "" extraction: "dom" --- ## Вступ Порожнє поле `date` означає одне: у розмітці сторінки дати немає – ані в `citation_date`, ані в структурованих даних, ані в `time[datetime]`. Сьогоднішнє число туди не підставляється: хибна дата в бібліографії гірша за відсутню, бо її не видно.
Три робочі ситуації
Препринт, який устиг змінитися
Ви цитуєте абзац із препринту й зберігаєте сторінку. Файл лягає в preprints як 2025-11-04-...md, date містить дату тієї редакції, source – адресу з номером версії. Через рік автори виклали третю редакцію, і адреса без номера віддає вже її.
Ваш текст спирається на абзац, якого в третій редакції немає. Збережений файл показує це за секунду: дата в шапці не збігається з датою живої сторінки, а сам абзац лежить перед вами. Без файлу лишалася б суперечка про те, що там було написано.
Матеріали, які видно тільки з університету
Додатки до статті відкриваються за інституційним доступом. Розширення читає ту сторінку, яку браузер уже намалював у вашій сесії, тож збереження нічим не відрізняється від публічної. Мережевих запитів воно не робить взагалі – сторінка не йде нікуди, крім вашого диска.
Що не збережеться – це PDF-файл додатка: бінарних файлів розширення не завантажує. Зате HTML-версія на порталах видавців зазвичай багатша на метадані, ніж сам PDF, і citation_date частіше є саме в ній.
Хронологія суперечки в одній теці
Тема розвивалася три роки: стаття, відповідь на неї, заперечення, огляд. Ви зберігали кожен матеріал у міру читання, і всі вони мають імена з датою публікації, а не з датою збереження.
Тека, відсортована за іменем, і є хронологією. Вона показує, що заперечення вийшло раніше за огляд, який на нього не посилається, – а це вже змістовне спостереження, а не бібліографічна дрібниця.
Проти звичних способів
Дослідники фіксують джерела всіма цими способами, часто кількома одразу. Третя колонка каже, чого кожен коштує, і про нас теж.
| Спосіб | Що виходить | Чого це коштує |
|---|---|---|
| Закладка на статтю | Адреса, миттєво | Веде на сьогоднішню редакцію; після перебудови порталу – у нікуди |
| Копіювання в документ | Текст, який можна цитувати | Дату й автора дописуєте руками, а виноски перетворюються на мертві якорі |
| Друк у PDF | Верстка сторінки цілком | Не шукається пошуком по теці, не порівнюється; метадані лишаються в зображенні сторінки |
| Менеджер бібліографії | Оформлений запис і поля | Тексту статті не зберігає – цитувати доводиться з живої сторінки |
| Скріншот розділу | Точна картинка | Не шукається, не цитується, і половина сторінки не влазить |
| Clean Clipper | Текст із датою, автором і адресою у frontmatter | Записів за ДСТУ чи APA не будує, PDF не завантажує, відкликань не перевіряє |
Коли метадані підвели
Чому поле date порожнє?
Бо сторінка ніде не оголосила дати. Розширення перевіряє citation_date, citation_publication_date, datePublished у структурованих даних, article:published_time, time[datetime] і мітки Unix – і не вигадує дати, коли жодного з них немає. Порожнє поле видно одразу, і ви допишете дату самі; підставлене сьогоднішнє число виглядало б правдою й тихо зіпсувало б бібліографію.
Чому автора не знайдено?
Розширення бере автора зі структурованих даних і підписів під заголовком, а очевидно хибні збіги відсіює – краще порожньо, ніж «Читайте також» у полі author. Ця обережність має ціну: на замірі зі 109 сторінок знайдено 20 авторів проти 28 у найкращого з порівнюваних рушіїв. Тут ми позаду, і це видно в самому вимірюванні.
Чому стаття, відкрита як PDF, не збереглася?
Бо в PDF немає DOM: браузер показує його вбудованим переглядачем, а не як сторінку. Розширення працює з відмальованим HTML, тож зберігати треба HTML-версію статті. На порталах видавців вона зазвичай є поруч і містить більше метаданих, ніж сам файл.
Чому виноски ведуть у нікуди?
Якщо в нотатці виноска не відкривається, майже завжди йдеться про посилання на якір усередині живої сторінки, а не про перелік джерел. Перелік джерел переїжджає визначеннями [^1] у кінець файлу й працює всередині нотатки. Внутрішні якорі сторінки лишаються звичайними посиланнями на неї – вони й мають вести на оригінал.
Чого воно не робить
Розширення не оформлює бібліографію: воно не будує запис за ДСТУ чи APA і не працює із BibTeX. Воно не завантажує PDF – зберігається та сторінка, яку відмалював браузер, а не файл за посиланням. Метаданих, яких на сторінці немає, воно не вигадує: ані DOI, ані назви журналу, ані номера випуску. І воно не перевіряє, чи стаття відкликана, – це лишається на вас.
Питання
Що буде, якщо на сторінці немає дати публікації?
Чи працюють виноски після збереження?
Чи можна зберегти статтю за інституційним логіном?
Чи зберігається PDF статті?
Наскільки надійно визначається автор?
Чи будує воно бібліографічний запис за ДСТУ або APA?
Чи можна працювати з BibTeX?
Чи перевіряє воно, чи статтю відкликано?
Що означає `extraction: "dom"` у моїх файлах?
jsonld-articlebody означає, що видимого тексту не було й тіло взято зі структурованих даних; ці дві копії подекуди розходяться, тож значення записується, а не ховається.Чи знайде воно дату на українських наукових сайтах?
citation_date, дата знаходиться; там, де дата є тільки словами в тексті, поле лишиться порожнім.