Cloudflare 已將 2026 年 9 月 15 日 設為 AI 公司必須將網頁爬蟲根據內容使用目的,區分為不同、可識別類別的最後期限。任何未清楚宣告其用途、或將搜尋索引與 AI 訓練綁定在同一個使用者代理下的爬蟲,在 Cloudflare 代理的流量上,尤其是顯示廣告的頁面,將被 預設封鎖 。
在此日期之後,新的 Cloudflare 客戶和新建立的網站 將採用預設設定,僅允許被清楚識別的搜尋爬蟲,同時封鎖 AI 訓練和 AI 代理爬蟲,除非發布者明確選擇允許 。現有的免費方案客戶,若未手動更新其偏好設定,也將被遷移至新的預設值
。
| 分類 | 定義 | 預設設定 (9 月 15 日起) |
|---|---|---|
| 搜尋 (Search) | 為內容建立索引,使其能出現在搜尋結果中,並將推薦流量導回發布者的爬蟲。 | 預設允許 — 這些機器人能帶來讀者和廣告收入。 |
| 代理 (Agent) | 代表使用者執行任務的機器人(例如,AI 助理執行操作、購物或預訂)。 | 預設封鎖 — 發布者必須選擇允許。 |
| 訓練 (Training) | 僅為訓練 AI 模型而抓取內容,不會回傳使用者或歸屬的爬蟲。 | 預設封鎖 — 發布者必須選擇允許。 |
發布者現在可以在單一儀表板上設定諸如「允許搜尋,封鎖訓練,封鎖代理」的政策,即使在免費方案上也能做到 。這比傳統的
robots.txt 更加精細,後者僅允許對每個使用者代理進行全面性的允許或拒絕。Cloudflare 自身的文件將搜尋定義為網站擁有者「應能期待獲得推薦流量或其他公平補償」的活動 。
Cloudflare 最初於 2025 年 7 月推出 按次付費 (Pay Per Crawl) 作為私人測試版——這是一個市場,發布者可以對 AI 公司的每次請求收費,使用 HTTP 402(「要求付款」)狀態碼來協商存取權限 。此系統允許發布者在未經批准的爬蟲請求內容時,回傳帶有定價資訊的 402 回應
。
到了 2026 年 4 月,在 Cloudflare 所謂的「代理週」(4 月 13 日至 17 日) 期間,該公司已將其發展為更廣泛的 按用量付費 (Pay Per Use) 模式,將按次抓取框架整合到一個適用於所有方案等級的單一運算主控台中 。關鍵區別如下:
Stack Overflow 的實作(2026 年 2 月)展示了正式版本:他們的資料授權計畫使用 Cloudflare 的機器人分類功能,對未經授權的爬蟲提供 402 回應,無需客製化合約即可大規模獲利 。