To nie jest drobna zmiana w ustawieniach. Cloudflare, który zarządza około 20% światowego ruchu internetowego, odwraca dotychczasową normę: z systemu opt-out (boty dozwolone, chyba że zablokowane) na opt-in dla botów powiązanych z AI . Dla wydawców oznacza to wbudowaną ochronę na poziomie korporacyjnym. Dla firm AI – koniec darmowego, masowego skrobania stron objętych Cloudflare.
Cloudflare wyznaczył 15 września 2026 jako ostateczny termin dla firm AI na rozdzielenie swoich botów na odrębne, zidentyfikowane kategorie, w zależności od tego, do czego będą wykorzystywać zeskanowane treści. Każdy bot, który nie ogłosi jasno swojego celu – lub który łączy indeksowanie w celach wyszukiwania z trenowaniem AI pod jednym user-agentem – zostanie domyślnie zablokowany w ruchu pochodzącym z Cloudflare, szczególnie na stronach wyświetlających reklamy .
Po tej dacie nowi klienci Cloudflare i nowo utworzone strony będą mieć domyślne ustawienia zezwalające tylko na wyraźnie zidentyfikowane boty wyszukiwania, blokując boty trenowania AI i boty agentów – chyba że wydawca wyraźnie włączy je ręcznie . Obecni klienci korzystający z darmowego planu, którzy nie zaktualizują swoich preferencji, również zostaną objęci nowymi ustawieniami domyślnymi
.
Wcześniej w internecie obowiązywała norma opt-out: boty były dozwolone, chyba że strona wyraźnie zablokowała je za pomocą robots.txt. Cloudflare odwrócił tę zasadę w przypadku botów związanych z AI .
Cloudflare wprowadził nową klasyfikację, która pozwala wydawcom ustawić niezależne reguły dla trzech zachowań botów. Jest dostępna dla wszystkich klientów, także tych na darmowym planie :
| Kategoria | Definicja | Ustawienie domyślne (od 15 września) |
|---|---|---|
| Search (Wyszukiwanie) | Boty indeksujące treści, aby mogły pojawiać się w wynikach wyszukiwania i kierować ruch polecający z powrotem do wydawcy. | Dozwolone domyślnie – te boty przynoszą czytelników i przychody z reklam. |
| Agent | Boty działające w imieniu użytkownika (np. asystenci AI wykonujący zadania, zakupy lub rezerwacje). | Blokowane domyślnie – wydawca musi wyrazić zgodę. |
| Training (Trenowanie) | Boty skrapujące treści wyłącznie w celu trenowania modeli AI, bez odsyłania użytkowników lub podawania źródła. | Blokowane domyślnie – wydawca musi wyrazić zgodę. |
Wydawcy mogą teraz ustawić politykę, np. „Zezwól na Search, zablokuj Training, zablokuj Agent” z jednego panelu, nawet na darmowym planie . To znacznie bardziej szczegółowe niż tradycyjny
robots.txt, który pozwalał tylko na globalne zezwolenie lub blokadę dla danego user-agenta. W dokumentacji Cloudflare kategoria Search jest zdefiniowana jako aktywność, w ramach której „właściciele stron powinni spodziewać się ruchu polecającego lub innej godziwej rekompensaty” .
Cloudflare wprowadził Pay Per Crawl w lipcu 2025 roku jako prywatną betę – rynek, na którym wydawcy mogli pobierać opłaty od firm AI za każdą sesję skanowania, używając kodu statusu HTTP 402 („Payment Required”) do negocjowania dostępu . System pozwalał wydawcom na zwrócenie odpowiedzi 402 z informacją o cenie, gdy niezatwierdzony bot żądał treści
.
Do kwietnia 2026 roku, podczas Tygodnia Agentów Cloudflare (13-17 kwietnia), firma rozwinęła ten system w szerszy model Pay Per Use, włączając ramy per-crawl do jednej konsoli operatorskiej dostępnej na wszystkich poziomach planów . Kluczowa różnica:
Wdrożenie Stack Overflow (luty 2026) pokazało produkcyjną wersję: ich program licencjonowania danych wykorzystuje kategoryzację botów Cloudflare do wysyłania odpowiedzi 402 nieautoryzowanym botom, monetyzując na dużą skalę bez konieczności indywidualnych umów .
robots.txt, które wykraczają poza dostęp na poziomie strony, pozwalając wydawcom sygnalizować, czy ich treści mogą być używane do indeksowania wyszukiwania, trenowania AI lub przez agentów AI