Clean Web Clipper 加到 Chrome(免費)

適用對象

以帶日期的筆記追蹤其他產品的更新

以書籤保存的競品研究,會慢慢退化成一串無法搜尋的連結。擷取成 Markdown 後,它就成為一批你能 grep、能和上一季擷取比對差異,並能連同日期引用在決策文件中的資料。

變得無法使用的研究資料

名為「競爭對手」的書籤資料夾有九十個項目。一半跳轉到改版後的行銷頁面,四分之一需要團隊裡已經沒人擁有的登入,而沒有一個能告訴你頁面在三月時怎麼寫。有人問某個對手是在你們之前還是之後推出某項功能時,答案就在一個之後已被改寫的頁面上。

截圖也救不了它。截圖無法搜尋,除了檔案時間戳記之外沒有日期,把截圖貼進決策文件,只會引來「頁面其他地方寫了什麼」的問題。在審查中站得住腳的,是文字本身,連同頁面宣告的日期,存在一個六個月後仍能 grep 的檔案裡。

而且訊號分散在長得完全不一樣的頁面上。更新紀錄說明推出了什麼,文件說明它實際上做什麼,價格頁說明它為誰而做,狀態頁說明它多常壞掉,論壇討論串則說明客戶對這四者的看法。沒有任何東西替你監看它們:你想到才去看,而那天沒擷取的內容就這樣消失了,因為這些頁面都沒有保留訪客能讀到的歷史紀錄。

這批資料能給你什麼

更新紀錄條目保留真正的日期code.visualstudio.com/updates
---
title: "Version 1.96: release notes"
source: "https://code.visualstudio.com/updates/v1_96"
date: "2024-12-11"
extraction: "dom"
---

## Workbench

- **Search results in the editor.** Results now open as an editor tab.
- **Custom window title.** New variables for the active profile and branch.

## Extension authoring

- The proposed API for terminal shell integration is now stable.

建立競品資料庫

設定內容就是個別網站規則,加上行事曆上的一個固定時段。兩者都不聰明,但合起來就是整套方法。

  1. 從擴充功能圖示開啟選項,把存放位置指向團隊都能讀取的資料夾:research/competitors,最好放在儲存庫裡,歷史紀錄就自動有了。
  2. 為每個競爭對手新增一條個別網站規則:他們的網域對應自己的子資料夾。之後就不需要手動歸檔,而這正是這批資料能撐過忙碌一季的唯一原因。
  3. 按下圖示時的動作設為「存到資料夾」。擷取的成本必須低於決定要不要擷取,否則你只會擷取那些你早就知道重要的頁面。
  4. 把檔名範本設為 {date}-{title},這樣同一份更新紀錄的四次擷取,會在該競爭對手的資料夾中依時間排列。
  5. 在 frontmatter 中開啟 sourcedate。發布日期是頁面自己的日期,讓你能說對手是在三月推出某項功能,而不是你在三月注意到它。
  6. 把圖片設為略過。行銷截圖是競爭對手頁面中最大、也最沒用的部分,而且每次改版網址都會變。
  7. 在行事曆上排一個固定時段,每次擷取同樣的五個頁面:更新紀錄、價格頁、重疊功能的文件頁、狀態頁,以及目前正熱烈討論他們的那個討論串。

長期追蹤的設定

這裡的一切都是為第二次擷取而最佳化,而不是第一次。每個頁面只擷取一次的資料庫,不過是多了幾個步驟的書籤清單。

設定為什麼在這裡用這個值
按下圖示存到資料夾擷取的成本必須低於決定要不要擷取
存放位置共用的 `research/competitors` 資料夾只有一個人讀得到的資料庫,只是個人興趣
個別網站規則每個競爭對手一個子資料夾手動歸檔正是忙碌的一季裡最先停下來的步驟
檔名範本`{date}-{title}`同一份更新紀錄的四次擷取,不需任何工具就依時間排列
Frontmatter開啟 `source` 和 `date`讓決策文件說出對手何時推出,而不是你何時注意到
圖片略過行銷截圖是頁面中最占空間、也最無法引用的部分
頻率同樣五個頁面,固定時段差異比對才是成果,而差異比對需要兩次擷取
限制表格,連同頁面宣告的日期一起擷取競爭對手的文件頁面
---
title: "Rate limits"
source: "https://example-api.com/docs/limits"
date: "2026-02-19"
extraction: "dom"
---

| Plan       | Requests / min | Burst | Retention |
| ---------- | -------------- | ----- | --------- |
| Starter    | 60             | 120   | 7 days    |
| Team       | 600            | 1200  | 30 days   |
| Enterprise | negotiated     | –     | 365 days  |

Limits are applied per organisation, not per key.

它能回答的三個問題

誰先推出的

對手宣布推出一項你們從春天就在測試的功能,會議室裡對事情的先後順序意見分歧。你對他們版本說明的擷取帶有頁面自己宣告的日期,所以順序是從檔案確立的,而不是從記憶。

頁面自己的日期正是重點。檔案時間戳記說的是你何時擷取;宣告 12 月 11 日的更新紀錄條目說的是他們何時發布,這是兩個不同的事實,而截圖會把兩者混為一談。

沒人宣布的價格變動

你每季擷取一次某個競爭對手的限制頁面。在兩次擷取之間,入門方案的突發額度減半,最高方案的保存期限變為三倍,沒有部落格文章,也沒有更新紀錄條目:頁面就只是寫得不一樣了。

差異比對只有三行,卻改變了一個定位論點。兩次擷取單獨看都不起眼,這正是為什麼這個方法只有在擷取便宜到能在你知道什麼會重要之前就做時才有效。

經得起審查的決策文件說法

建議書引用了對手文件中記載的速率限制。這個引用來自一個上方附有來源網址和日期的檔案,所以想查核的審查者會直接打開檔案,而不是請你再去找一次那個頁面。

完全由行銷區塊組成的頁面是值得知道的例外:這些頁面往往沒有文章內文,擴充功能會回報「沒有文章」,而不是傳回一頁連結。遇到這種情況,文件頁面通常會以你真正能引用的形式寫著同樣的說法。

和一般的競品研究相比

團隊通常會做前兩種,偶爾付費用第三種,卻很少持續做其中任何一種。下面列出的代價,正是讓持續變得困難的原因。

目前的做法你得到什麼代價是什麼
書籤資料夾一份該去哪裡看的清單每個項目都指向今天的頁面;一年內一半會跳轉
共用雲端硬碟裡的截圖頁面當時的樣子無法搜尋、除了檔案之外沒有日期,也無法引用其中一句
頁面監控服務頁面改變時的通知要訂閱付費,而且只監看你事先想到的頁面
打進文件的筆記你對頁面的解讀是轉述而不是證據;六個月後沒人分得清哪個是哪個
Clean Web Clipper可以 grep 和比對差異的帶日期文字檔沒有監控也沒有通知。你去看時才擷取,它不會替你監看

競爭對手頁面擷取不下來時

價格頁回傳「沒有文章」

現代的行銷頁面常常完全由設計元件組成,根本沒有文章內文,擷取出的文字有超過約四分之一落在連結文字和按鈕標籤中。擴充功能會拒絕這種頁面,而不是傳回一頁碎片。文件頁或條款頁通常會以段落形式寫著同樣的限制,那些頁面可以正常擷取。

只擷取到最新的版本說明

更新紀錄常常分頁,或把較舊的條目藏在「顯示更多」控制項後面。擴充功能讀取的是擷取那一刻的 DOM,所以還沒載入的內容根本不存在、無從擷取。先展開清單,或把封存的每一頁都擷取下來。這些檔案可以並排放在該競爭對手的資料夾裡。

個別條目沒有日期

date 欄位存的是整個頁面的一個日期,取自頁面自己的中繼資料,而不是每個條目各一個。更新紀錄若把日期寫在每個條目的內文中,它會以內文形式擷取下來,依然清楚可讀。網站完全沒有輸出日期時,欄位會留空而不是填上今天;在某些語料中,這種情況相當常見,並不罕見。

我需要知道它何時改變,而不只是改變了

這是這個方法誠實的極限:沒有監控、沒有通知,也沒有排程重新擷取,所以你紀錄的精細度就是你擷取的頻率。每季擷取一次的頁面,只能告訴你改變發生在某一季之內。如果時間點本身就是決策關鍵,監控服務才是合適的工具,這個不是。

它不會做的事

它不會替你監看頁面:沒有監控、沒有通知,也沒有排程重新擷取。你去看的時候才擷取。沒有爬蟲也沒有批次模式,所以文件網站要一頁一頁擷取。完全由設計區塊組成、沒有文章內文的行銷頁面,可能會被回報為「沒有文章」,因為擴充功能寧可直說,也不傳回一頁連結。它也不會替你比對差異;它產生的是任何差異比對工具都能比較的檔案。

加到 Chrome(免費)完全免費。不需要帳號、不需要註冊,也沒有任何限制。

常見問題

可以把每個競爭對手放在不同資料夾嗎?
可以。這正是個別網站規則的用途。一個網址模式對應自己的子資料夾、自己的圖片設定和自己的 frontmatter 欄位,而且不用任何費用。
價格頁擷取得好嗎?
價格表通常能保留下來。完全由行銷區塊組成、沒有文章內文的頁面,可能會被回報為「沒有文章」:擴充功能寧可直說,也不傳回一頁連結。
競爭對手修改頁面時,它能通知我嗎?
不能。沒有監控也沒有通知。你去看時才擷取,再把新檔案和舊檔案比較。
可以一次擷取多個分頁嗎?
不行。它一次擷取一個你正在看的頁面;沒有批次模式,也沒有爬蟲。
有任何需要付費的部分嗎?
沒有。個別網站規則、vault、檔名範本和其他所有功能都免費,也不需要帳號。
整個團隊可以共用這批資料嗎?
可以,而且值得這麼做。檔案是純文字,所以共用資料夾或儲存庫都行,差異比對在 pull request 中也讀得懂,別人擷取的內容,不需要安裝擴充功能就能閱讀。
競爭對手會看到我擷取了他們的頁面嗎?
不會。擴充功能不會告訴他們任何事:它讀取的是你的瀏覽器已經載入的頁面。他們的紀錄只會記下你那次造訪,和你只是讀完就關掉分頁時完全一樣。
可以擷取競爭對手試用帳號中的頁面嗎?
擴充功能讀取瀏覽器為你的工作階段呈現的任何內容,所以技術上可以。你能否保存受其服務條款約束的資料副本,由那些條款決定,而擷取不會改變條款的內容。
更新紀錄的標題和項目符號保留得下來嗎?
可以。標題保留層級,巢狀項目符號保留巢狀,條目開頭的粗體標籤也維持粗體;這很重要,因為更新紀錄通常就是用這種方式區分新功能和修正。
我實際上要怎麼比較兩次擷取?
用任何差異比對工具,包括你編輯器裡的,或版本控制平台上的。這正是輸出採用逐行文字的全部理由:不需要特殊檢視器、不需要匯入步驟,而且差異比對能讓同事在 pull request 中讀懂。