För vem
Arkivera en källa innan den ändras
Sidor skrivs om och plockas ned, oftast utan att det står något om det. En sparad kopia med källadress, publiceringsdatum och hela texten är ett underlag du kan peka på senare, och den ligger på din egen disk. Fältet extraction antecknar dessutom hur texten hämtades, så anteckningen går att granska.
Varför en källa springer i väg
Ett pressmeddelande justeras, ett stycke faller bort ur en artikel, en prislista på en företagssajt byts ut. Sällan står det att något har ändrats, och länken du hade i anteckningarna pekar nu på den nya versionen. Ringer du upp dagen efter går meningen du citerade inte längre att hitta.
En skärmbild löser det bara till hälften. Du kan inte söka i den, texten går inte att kopiera, och datumet på den är den dag du tittade, inte publiceringsdatumet. En bokmärkestjänst flyttar i stället problemet till en tredje part som kan lägga ned eller stänga ditt konto, och då är hela materialet borta.
Vad kopian innehåller
- Publiceringsdatumet läses ur sidans egna metadata, inte ur brödtexten
- Källadressen i frontmatter i varje anteckning, så ursprunget följer med
- Hela artikeltexten utan navigering och puffar som byts ut mellan besöken
- Fältet
extractionvisar hur texten hämtades –domellerjsonld-articlebody - Vanliga filer: inget låst format, inget konto, ingen tjänst som kan dra in åtkomsten
- På Reddit följer kommentarerna med som en kompakt tråd, med poängen för varje inlägg
--- title: "Nya villkor för datacenter börjar gälla vid årsskiftet" source: "https://www.svt.se/nyheter/inrikes/artikel-4812" date: "2024-06-11T14:22:00.000Z" extraction: "dom" --- De nya villkoren gäller från den 1 januari och omfattar även tillstånd som redan är utfärdade, enligt myndighetens kommentar.
Vad det inte är
Det här är inget webbarkiv. Det sparar texten och inte sidan som den visades: ingen layout, inga skärmbilder, inga bifogade filer. Det är heller inget bevis med tidsstämpel från tredje part – datumet i frontmatter kommer från sidan själv, och {date} är dagen du sparade. För ett visuellt eller juridiskt hållbart underlag behövs en arkivtjänst vid sidan om.
Frågor
Ersätter det här en webbarkivtjänst?
Fångar det kommentarer?
Kan det notera när jag sparade sidan?
{date}, som är dagen du sparade. Publiceringsdatumet förblir ett eget fält, så de två blandas aldrig ihop.Fungerar det bakom en redaktionsinloggning eller en betalvägg?
Går det att se om texten kom från sidan eller ur metadatan?
extraction: dom betyder från det webbläsaren visade, jsonld-articlebody betyder att sidan bara hade texten i sina strukturerade data.