Clean Web Clipper Chrome에 추가 (무료)

누구를 위한 도구인가

법령을 한 글자도 바꾸지 않고 캡처하기

법령, 서비스 약관, 공식 지침은 예고 없이 바뀝니다. 출처 주소와 페이지가 밝힌 날짜를 담은 Markdown 사본은 내가 읽은 날 그 텍스트가 무엇이라고 했는지의 기록입니다.

문언 자체가 사실일 때

공급업체가 약관을 고치고, 지침이 다시 발행되고, 포털이 조항을 새 번호로 재게시하면, 내가 자문한 버전은 그 주소에 더 이상 없습니다. 스크린숏은 문서가 아니라 화면 한 칸을 담습니다. PDF로 인쇄하면 쿠키 배너는 들어오고 기준 금액 표는 빠집니다. 그리고 범용 변환기를 거친 페이지는 조항 번호가 평문으로 뭉개진 채 도착합니다.

중요한 세부는 바로 변환이 잘 망가뜨리는 부분입니다. 셀 하나에 목록이 있으면 수수료 표가 무너집니다. 각주는 이미 떠난 페이지를 가리키는 죽은 앵커가 됩니다. 호·목 번호가 위 문단에 합쳐집니다. 결과물은 여전히 그럴듯하게 읽히고, 구조가 옮겨졌다는 신호가 없으므로 뚜렷한 실패보다 더 나쁩니다.

페이지가 파일로 가는 도중 어디를 거치느냐는 문제도 있습니다. 변환을 위해 페이지 내용을 서버로 보내는 클리퍼는 내가 읽던 것을 읽는 그 순간 제3자에게 보내는 셈이고, 변호사가 무엇을 읽는지는 그 자체로 의뢰인에 관한 정보입니다. Clean Web Clipper는 읽은 것을 업로드하지 않고 읽는 사이트에 대한 권한도 요청하지 않으므로, 클릭한 탭만, 클릭한 순간에만 읽을 수 있습니다. 쓰는 파일에도 업체가 딸려 있지 않으며, 이는 몇 년 뒤에도 사건 기록을 열어야 할 때 다시 중요해집니다.

변환 뒤에도 살아남는 것

조·항 구조가 변환 뒤에도 그대로 남습니다law.go.kr: 개인정보 보호법 제36조
---
title: "개인정보 보호법 제36조"
source: "https://www.law.go.kr/법령/개인정보보호법"
extraction: "dom"
---

## 제36조(개인정보의 정정·삭제)

① 제35조에 따라 자기의 개인정보를 열람한 정보주체는 개인정보처리자에게
   그 개인정보의 정정 또는 삭제를 요구할 수 있다. 다만, 다른 법령에서
   그 개인정보가 수집 대상으로 명시되어 있는 경우에는 그 삭제를 요구할 수 없다.

② 개인정보처리자는 제1항에 따른 정보주체의 요구를 받았을 때에는 …

사건 기록용으로 설정하기

아래 설정은 몇 년 뒤 그 자리에 없었던 다른 누군가가 파일을 읽는다고 가정합니다. 내일 내가 읽는 것과는 다른 요구입니다.

  1. 확장 프로그램 아이콘에서 옵션을 열고 저장 위치를 사건 문서가 있는 폴더로 설정합니다. 하위 폴더 칸에 사건 번호를 넣으세요. 다음 사건으로 넘어갈 때는 이 칸 하나만 바꾸면 됩니다.
  2. 아이콘 클릭은 미리보기 창으로 둡니다. 법률 자료에서는 2초가 아깝지 않습니다. 조항 번호와 수수료 표가 바로 변환이 망가뜨리는 부분이고, 파일이 생기기 전에 그것을 보는 곳이 창입니다.
  3. 파일 이름 템플릿을 {date}-{domain}-{title}로 설정합니다. 같은 조항이 네 곳의 주소에 있을 때 버전을 특정하는 것은 캡처한 날과 게시 기관입니다.
  4. extraction까지 모든 frontmatter 필드를 켭니다. 텍스트가 구조화 데이터가 아니라 렌더링된 페이지에서 왔다는 기록은 질문을 만들기보다 질문에 답하는 종류의 세부입니다.
  5. 이미지를 제외로 설정합니다. 공식 페이지의 이미지는 기관 로고, 공유 버튼, 텍스트가 없던 도식이고, 사건 기록의 깨진 이미지 링크는 캡처하지 않은 것이 아니라 무언가 빠진 것으로 읽힙니다.
  6. 조항 페이지와 “시행일” 또는 버전 안내 페이지를 별개의 클립 두 개로 캡처합니다. 날짜가 서로 다르고, 시행일이 나오는 곳은 버전 페이지뿐인 경우가 많습니다.
  7. 검토 날짜마다 같은 페이지를 다시 클리핑합니다. 두 번째 파일에 숫자 접미사가 붙고, diff 도구가 자문한 버전과 현행 버전 사이에 무엇이 바뀌었는지 보여 줍니다.

법률 자료용 설정

기본값과의 차이는 주로 신중함입니다. 저장하기 전에 확인하고, 경로를 기록하고, 두 번째 캡처가 첫 번째를 덮어쓰지 않게 합니다.

설정여기서 이 값인 이유
아이콘 클릭미리보기 창변환이 깨뜨리는 것이 조항 번호와 수수료 표입니다. 저장 전에 보세요
저장 위치사건 폴더, 사건 번호를 하위 폴더로기록은 일반 클립 더미가 아니라 사건에 속합니다
파일 이름 템플릿`{date}-{domain}-{title}`같은 조항이 여러 주소에 게시됩니다. 기관과 캡처 날짜가 어느 것인지 특정합니다
frontmatter모든 필드(`extraction` 포함)텍스트가 거친 경로도 기록의 일부이고, 기록하는 데 한 줄이면 됩니다
이미지제외로고와 공유 아이콘뿐이고, 파일의 깨진 이미지 링크는 기록의 공백처럼 보입니다
사이트별 규칙규제 기관·등기소 도메인 → 전용 하위 폴더1차 자료와 해설은 함께 보관하지 않는 편이 좋습니다
반복 캡처검토 날짜마다 다시 클리핑숫자 접미사가 둘 다 남기고, diff에는 파일 두 개가 필요합니다
각주가 그대로 연결되는 수수료 표공공기관 수수료 안내 페이지
## 별표 2 – 납부 수수료

| 신청 종류                  | 수수료        | 기한          |
| -------------------------- | ------------- | ------------- |
| 최초 등록                  | 62,000원[^1]  | 28일 이내     |
| 류(類) 추가 1개마다        | 20,000원      | 신청과 함께   |
| 기한 후 갱신               | 20,000원[^2]  | 6개월 이내    |

[^1]: 온라인으로 제출하지 않은 경우 72,000원.
[^2]: 갱신 수수료와 별도로 납부합니다.

실무의 세 가지 쓰임

공급업체 약관, 변경 전과 후

자문하는 날 공급업체의 서비스 약관을 클리핑합니다. 11개월 뒤 책임 한도 조항의 문구가 달라져 있는데, 사이트 어디에도 버전 기록이 없고 고객에게 통지도 없었습니다.

두 번째 캡처가 덮어쓰지 않고 숫자 접미사를 받았으므로 두 파일이 사건 폴더에 있고, diff 도구가 바뀐 조항을 메모에 첨부할 수 있는 형태로 출력합니다. 스크린숏으로 이것을 재구성하려면 이미지 두 장을 나란히 놓고 읽으며 운에 맡겨야 했을 것입니다.

각주가 살아 있는 수수료표

공식 수수료 페이지에 3열 표가 있고, 금액 두 개에 각주 표시가 붙어 있으며, 각주 내용은 페이지 하단에 있습니다. 표는 표로 옮겨지고, 참조 링크는 노트 끝에 모인 [^1][^2] 정의가 됩니다.

각주는 범용 변환기가 잃어버리는 부분입니다. 참조 링크가 새니타이저가 지우는 요소 id에 기대기 때문입니다. 여기서는 새니타이저가 실행되기 전에 각주를 모읍니다. 수수료에 붙은 단서가 살아남느냐를 가르는 순서의 문제입니다.

번호가 바뀌어 재발행된 지침

규제 기관이 문단 번호를 바꾸고 두 문단을 합쳐 지침을 재게시합니다. 이전 캡처가 있으므로, 의뢰인에게 보내는 메모에 옛 텍스트의 어느 문단이 새 텍스트의 어느 부분이 되었는지 양쪽을 인용해 적을 수 있습니다.

URL은 그대로이고 페이지는 현재 상태만 보여 주므로, 캡처가 없으면 비교할 것이 없습니다. 게시 기관의 자체 보관 자료에 사본이 있을 수도, 없을 수도 있습니다. 파일이 있는 이유는 시간에 쫓기며 그것을 확인하지 않아도 되게 하려는 것입니다.

페이지를 보관하는 흔한 방법과 비교

이 표에서 중요한 것은 마지막 행입니다. 이 도구는 증거가 아니라 작업 기록이며, 그 구분이 중요한 곳에서는 매우 중요합니다.

지금 쓰는 방법얻는 것치르는 비용
조항 스크린숏화면에 있던 것, 눈으로문서가 아니라 화면 한 칸. 긴 조항에는 이미지가 열 장 넘게 필요
페이지를 PDF로 인쇄페이지 모양의 사본쿠키 배너까지 들어가고, 기준 금액 표가 빠지는 경우가 많으며, 텍스트 diff 불가
페이지를 HTML로 저장완전한 로컬 사본문서로 읽기 어렵고, 두 캡처 간 diff도 읽을 수 없음
인증 아카이브·공증 서비스독립적이고 타임스탬프가 찍힌 사본페이지마다 비용과 시간이 들고, 어떤 페이지가 중요할지 미리 정해야 함
사건 메모에 복사즉시 얻는 문구호·목 표시가 평문에 합쳐지고 출처 주소가 따라오지 않음
Clean Web Clipper문언 그대로의 텍스트, 구조, URL, 밝힌 날짜타임스탬프도 서명도 없음. 제3자에 대한 증명이 아니라 내가 본 것의 기록

변환이 깔끔하지 않을 때

문서 목록이나 검색 페이지가 기사 없음으로 나왔습니다

문서 목록, 판례 검색, 결과 목록은 대부분 링크 텍스트이고, 확장 프로그램은 추출된 글자의 약 4분의 1 이상이 링크 안에 있는 페이지를 거절합니다. 문서 자체를 열어 그것을 클리핑하세요. 거절은 의도된 것입니다. 조항이라는 이름이 붙은 링크 텍스트 300개가 든 사건 기록은 빈 기록보다 나쁩니다.

조항 번호가 사라졌습니다

번호가 페이지 텍스트에 실제로 있는지 확인하세요. 사이트가 순서 목록을 제대로 마크업했다면 중첩과 번호가 옮겨집니다. 번호를 스타일시트가 그린다면(문서 속 문자가 아니라 생성된 카운터라면) 텍스트에 캡처할 것이 없고, 렌더링 지시로만 존재하는 번호는 어떤 확장 프로그램도 읽을 수 없습니다. 해결책은 실제 번호가 들어 있는 버전, 흔히 인쇄용이나 “텍스트 보기” 화면을 클리핑하는 것입니다.

공식 버전이 PDF입니다

그렇다면 이 도구는 맞지 않습니다. 확장 프로그램은 렌더링된 HTML을 변환하고, 공식 자료의 상당수는 PDF로만 게시됩니다. 조항이 두 형식으로 모두 있다면 HTML을 클리핑하고 PDF를 함께 보관하세요. PDF로만 있다면 PDF를 보관하고 안내 페이지를 클리핑해 최소한 주소와 날짜라도 기록하세요.

날짜 필드가 비어 있거나 개정일이 나옵니다

확장 프로그램은 페이지가 자체 마크업에 밝힌 날짜만 기록합니다. 많은 공식 페이지는 날짜를 밝히지 않으며, 그러면 읽은 날로 채우지 않고 비워 둡니다. 어떤 페이지는 최초 게시일이 아니라 최종 개정일을 밝힙니다. 그것이 페이지가 스스로에 대해 말하는 내용이고, 해석하지 않고 그대로 옮깁니다. 사이트가 시행일을 게시한다면 대개 본문 페이지가 아니라 버전 페이지에 있습니다.

주장하지 않는 것

인증된 아카이브가 아닙니다. 제3자 타임스탬프도 서명도 없으므로, 파일은 내가 무엇을 저장했는지 기록할 뿐 다른 사람에게 증명하지 않습니다. 공식 자료의 상당수가 게시되는 형식인 PDF는 읽지 않습니다. 해석하거나, 조항을 추출하거나, 개정을 추적하지 않습니다. 페이지를 변환합니다. 그리고 문서 목록이나 검색 결과에는 기사 본문이 없으므로, 링크 목록을 돌려주는 대신 “기사 없음”을 알립니다.

Chrome에 추가 (무료)전부 무료입니다. 계정도, 가입도, 제한도 없습니다.

자주 묻는 질문

텍스트가 어떤 식으로든 수정되나요?
구조만 바뀝니다. HTML이 Markdown이 됩니다. 기사 본문 안의 단어는 추가, 삭제, 재배열되지 않습니다. 기사 주변의 내비게이션과 홍보 블록은 제거되고, 확장 프로그램은 어떤 추출 경로를 썼는지 기록합니다.
복잡한 표도 남나요?
대개 남습니다. Clean Web Clipper는 범용 변환기에 기대지 않고 표를 직접 직렬화하며, 표 15개짜리 코퍼스에서 12개가 남았고 비교한 엔진은 각각 7개였습니다. 깊이 중첩된 레이아웃용 표는 어떤 도구에게나 어렵습니다.
법령 PDF를 클리핑할 수 있나요?
아니요. 페이지의 렌더링된 HTML을 변환합니다. 조항이 두 형식으로 모두 게시되어 있다면 HTML 버전을 클리핑하세요.
파일은 어디에 저장되나요?
내 디스크에서 고른 폴더에 저장됩니다. 클리핑한 것은 어디에도 업로드되지 않습니다.
의뢰인 업무에 써도 되나요?
네. 개인용과 업무용 모두 무료이고, 관리할 라이선스도 발급할 계정도 없습니다.
기밀 사건에 써도 안전한가요?
확장 프로그램은 읽는 사이트에 대한 권한을 요청하지 않으므로 브라우징을 관찰할 수 없고, 페이지의 텍스트, 제목, 내용은 절대 컴퓨터를 떠나지 않습니다. 다만 성공한 클립의 도메인, 변환에 실패한 페이지의 주소, 연 확장 프로그램 화면, 무작위 설치 번호는 전송됩니다. 기밀 사건에서는 설정에서 이를 끄면 아무것도 나가지 않습니다. 탭 접근은 아이콘 클릭이나 단축키로 내가 직접 허용하며 그 탭에 한합니다. 그 뒤 파일이 어디에 있고 누가 그 폴더를 읽을 수 있는지는 확장 프로그램이 아니라 소속 법인이 정할 문제입니다.
유료 법률 데이터베이스에서 클리핑할 수 있나요?
기술적으로는 됩니다. 확장 프로그램은 브라우저가 내 세션으로 렌더링한 페이지를 읽습니다. 사본을 보관해도 되는지는 그 데이터베이스의 이용 조건이 정하며, 체계적인 다운로드를 제한하는 경우가 많습니다. 클리핑이 그 조건의 내용을 바꾸지는 않습니다.
두 버전을 대신 비교해 주나요?
아니요. 파일을 쓸 뿐이고, 비교는 diff 도구의 일입니다. 출력이 일반 텍스트이므로 어떤 diff 도구로도 됩니다. 확장 프로그램이 보장하는 것은 두 번째 캡처가 첫 번째를 조용히 대체하지 않는다는 것입니다.
조항 간 상호 참조는 어떻게 되나요?
링크는 원래 주소를 가리키는 Markdown 링크가 되므로, 다른 법령에 대한 참조는 여전히 그 법령으로 이어집니다. 내부 앵커는 원래 페이지를 가리키고, 참조형 각주는 노트 끝의 [^1] 정의로 모입니다.
설정을 매번 바꾸지 않고 사건마다 폴더를 따로 둘 수 있나요?
사이트별 규칙은 사건이 아니라 URL 패턴으로 분류하므로, 규제 기관이나 등기소에는 고정 하위 폴더를 둘 수 있습니다. 사건 자체는 새 사건을 열 때 하위 폴더 칸 한 줄만 바꾸면 됩니다.