Para quem é
Material de referência que continua citável
Pesquisa guardada em print de tela ou em favorito deixa de servir na hora em que você precisa dar o crédito. O Clean Clipper salva o texto do artigo em Markdown com título, autor, data de publicação e endereço no frontmatter, num arquivo que é seu. A citação chega ao texto final com a origem colada nela.
A citação sem procedência
Você tem a frase perfeita nas anotações e não faz ideia de onde ela saiu. Está num print, num bloco de notas do celular ou num documento chamado “pesquisa 3”. O editor pede a fonte, e começa a arqueologia: buscar trechos entre aspas, abrir dez abas, tentar lembrar se era matéria ou entrevista. Às vezes você acha; quando não acha, a melhor frase do texto cai.
Quando a fonte aparece, falta a data. Sem ela não dá para dizer se aquele número ainda vale, e o revisor devolve o parágrafo. É um trabalho que não aparece em lugar nenhum e que se repete a cada pauta, sempre no fim do prazo, sempre quando você queria estar escrevendo.
E tem a conferência de última hora, que é quando o buraco fica caro. O editor pede para checar a redação exata de uma frase antes de fechar, você volta ao endereço e a matéria agora está atrás de cadastro, ou foi editada, ou saiu do ar. Sem uma cópia do texto como você leu, a saída é trocar a citação direta por uma paráfrase mais fraca – e isso acontece no fim do prazo, quando não sobra tempo para procurar outra fonte.
O que muda na sua pesquisa
- Título, autor, data de publicação e endereço da fonte no frontmatter de toda nota
- O texto do artigo sem a navegação, pronto para você tirar a citação de dentro
- Captura por seleção quando você quer só um parágrafo, e não a matéria inteira
- O autor passa por filtro: nome do veículo, título de seção e rótulo de botão não entram no campo author
- Modo de leitura para conferir a captura antes de arquivar
- Os arquivos caem na sua pasta, num formato que nenhuma empresa controla nem descontinua
- Zero resto de tag HTML nas 512 páginas medidas – nenhuma marcação solta atravessa junto com o trecho que você vai colar no texto
- Quando a fonte é uma discussão de fórum, a estrutura dos comentários e a pontuação de cada um chegam inteiras, e não achatadas em um bloco só
--- title: "O que a pesquisa brasileira publica" source: "https://revistapesquisa.fapesp.br/" author: "Revista Pesquisa FAPESP" date: "2024-09-05T00:00:00.000Z" extraction: "dom" ---
Preparar a pasta da pauta
A configuração inteira leva cinco minutos e vale para todas as pautas seguintes. O que ela resolve é uma coisa só: nenhum trecho chega ao seu texto sem a procedência colada nele.
- Instale a extensão e fixe o ícone. Abra as opções pelo botão direito e confira que o idioma da interface acompanha o do navegador.
- Aponte a pasta de destino para o diretório onde você já guarda a pesquisa da pauta, não para uma pasta genérica. A pesquisa e as capturas na mesma pasta é o que faz a busca por palavra responder alguma coisa.
- Ligue
title,source,authoredateno frontmatter. São os quatro campos que uma citação precisa ter, e o único momento barato de preenchê-los é o da leitura. - Coloque
{date}-{domain}-{title}no modelo de nome de arquivo. O domínio no nome evita que três veículos com a mesma manchete virem o mesmo arquivo com sufixo numérico. - Deixe o clique no ícone abrindo a janela de captura, e não gravando direto. Conferir no modo de leitura se o autor veio certo custa três segundos e evita um crédito errado impresso.
- Treine a captura por seleção: selecione o parágrafo, depois
Alt+Shift+M. Para uma citação, a nota que interessa tem cinco linhas, e uma matéria inteira arquivada é uma matéria que você vai reler.
Ajustes de quem escreve
Estes valores partem de uma exigência que não é negociável no texto publicado: toda frase entre aspas precisa chegar ao editor com origem, autor e data verificáveis.
| Configuração | Valor | Por que esse valor aqui |
|---|---|---|
| Pasta | A pasta da pauta em andamento | Pesquisa e capturas juntas é o que faz a busca por palavra funcionar |
| Frontmatter | `title`, `source`, `author`, `date` ligados | São exatamente os campos que uma citação precisa carregar |
| Modelo de nome | `{date}-{domain}-{title}` | Três veículos com a mesma manchete não viram o mesmo arquivo |
| Clique no ícone | Abrir a janela de captura | Conferir o autor antes de gravar evita crédito errado no texto impresso |
| Captura | Por seleção, quando for citação | Uma nota de cinco linhas se relê; uma matéria arquivada inteira, não |
| Imagens | Manter como link | A legenda de foto às vezes é a informação que sustenta o parágrafo |
--- title: "O bairro que virou rota de bicicleta em dois anos" source: "https://exemplo-veiculo.com.br/cidades/rota-de-bicicleta" author: "" date: "2025-11-18T06:00:00.000Z" extraction: "dom" --- A ciclofaixa foi pintada em março e a contagem de passagens dobrou até setembro, segundo a própria prefeitura. > A gente achava que era obra para o fim de semana. Virou o caminho do > trabalho de muita gente. O nome do veículo aparecia no topo da página, mas assinatura não havia: colocar ali a primeira frase plausível seria inventar um autor.
Três etapas de uma pauta
A frase que você vai citar entre aspas
No meio de uma entrevista publicada, há uma frase de quinze palavras que vale a citação. Você seleciona só ela e o parágrafo em volta, captura, e o arquivo cai na pasta da pauta com autor, veículo, data e endereço no cabeçalho.
Quando o texto for para a edição, a citação chega com a procedência anexada. O parágrafo em volta continua no arquivo, então dá para responder a pergunta que todo editor faz: a frase quer dizer isso mesmo, no contexto em que foi dita?
A fonte que muda de ideia
Você guarda a versão de hoje de uma nota oficial. Três semanas depois, a mesma página está com um parágrafo a menos e ganhou uma linha de correção no rodapé.
Os dois arquivos estão na mesma pasta, com o mesmo source e datas de captura diferentes. Uma comparação de texto entre eles mostra exatamente o que saiu, e essa é a diferença entre escrever “o texto foi alterado” e escrever qual trecho foi alterado.
A pesquisa que vira um texto seis meses depois
Você acumulou trinta capturas sobre um assunto ao longo de meio ano, sem saber ainda que texto sairia dali. Todas em Markdown, todas com endereço e data.
Na hora de escrever, uma busca por palavra dentro da pasta devolve os sete arquivos que interessam, com o contexto em volta de cada ocorrência. Um acervo de favoritos não responderia essa pergunta, porque favorito não guarda texto – guarda endereço.
Comparado com o jeito de sempre
Cada uma destas soluções resolve alguma parte do problema, e é por isso que todas continuam em uso. A terceira coluna diz o que cada uma cobra, esta extensão inclusive.
| Como se guarda hoje | O que fica guardado | O que custa |
|---|---|---|
| Print da tela | A página como ela apareceu | Não entra em busca, corta na margem e não carrega endereço nem data |
| Bloco de notas do celular | O trecho, na hora em que você leu | Chega sem fonte, e reconstituir a origem depois é arqueologia |
| Copiar para um documento de texto | O texto, com formatação estranha junto | Quinze minutos de limpeza por fonte, e o crédito se perde no caminho |
| Mandar o link para si mesmo | Um ponteiro, em dois segundos | O ponteiro resolve para o que a página disser no dia da conferência |
| Guardar nos favoritos | Uma lista organizada de endereços | Não guarda texto nenhum; matéria atrás de cadastro deixa de abrir |
| Clean Clipper | Texto com título, autor, data e endereço em um arquivo | Sem layout, sem print, sem carimbo de tempo; o campo de autor fica vazio quando a página não assina |
Quando o cabeçalho vem incompleto
Por que o campo author está vazio?
Porque a página não declarou autoria de forma que dê para confiar. A extensão lê os dados estruturados e as assinaturas, e derruba os falsos positivos conhecidos – nome do veículo, título de seção, rótulo de botão. Quando nada passa, o campo fica em branco. É melhor assim: um autor inventado a partir da primeira frase plausível vira crédito errado no texto publicado.
Por que a data do arquivo não bate com a que aparece na página?
Muita matéria mostra a data de atualização na tela e declara a data de publicação nos metadados, ou o contrário. A extensão lê os metadados, não o texto exibido. Quando as duas importam para a pauta, o jeito é anotar a segunda à mão no arquivo, que é texto comum e aceita edição.
Por que a matéria de assinante veio pela metade?
Porque a página só entregou metade. Em muitos veículos, o texto atrás da assinatura só entra no DOM depois que o navegador confirma a sessão; se você não está logado, o que existe na página são os primeiros parágrafos e uma chamada para assinar. Logue, espere a matéria completa aparecer na tela e capture então: a extensão converte o que está renderizado, nada além.
Por que entrou uma chamada de outra matéria no meio do texto?
Porque o site colocou aquele bloco dentro do corpo do artigo, e não ao lado dele. Quando a chamada está dentro do mesmo contêiner do texto, ela é parte do artigo do ponto de vista da estrutura da página. O modo de leitura mostra isso antes de gravar, e apagar duas linhas no arquivo é rápido – o que a extensão não faz é adivinhar qual parágrafo o editor considerava publicidade.
O que ele não faz
Ele não guarda a página como imagem: não tira print, não salva o layout e não baixa os arquivos de mídia. Não gera referência formatada – o que sai é o metadado bruto no frontmatter, e a formatação é sua. Quando a página não declara autor, o campo fica vazio, porque colocar ali a primeira frase plausível é pior que deixar em branco. E ele não verifica nada: guardar o texto não torna o texto verdadeiro.