Mulai 15 September 2026, Cloudflare akan memblokir semua crawler AI 'campuran' (mixed use) secara default di halaman yang menampilkan iklan, memaksa perusahaan AI seperti Google untuk memisahkan crawler pencarian, pel... Cloudflare memperkenalkan sistem tiga kategori baru (Search, Agent, Training) yang memungkinkan...
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What changes is Cloudflare implementing by September 15, 2026, regarding how it handles AI crawle. Article summary: Here is a fact-checked, evidence-backed breakdown of Cloudflare's September 15, 2026 deadline and its three-part policy shift.. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it us
Mulai 15 September 2026, Cloudflare akan memblokir semua crawler AI yang menggabungkan fungsi pengindeksan pencarian dengan pelatihan AI atau tugas agen dalam satu user-agent, kecuali jika publisher secara eksplisit mengizinkannya .
Ini bukan sekadar perubahan pengaturan kecil. Cloudflare, yang mengelola sekitar 20% lalu lintas web global, membalikkan default internet dari mode 'keluar' (crawler diizinkan kecuali diblokir) menjadi mode 'masuk' (harus diizinkan) untuk crawler khusus AI . Bagi publisher, ini berarti perlindungan bot kelas enterprise langsung jadi. Bagi perusahaan AI, ini berarti berakhirnya era scraping web skala besar secara gratis dari situs-situs yang menggunakan Cloudflare.
Cloudflare menetapkan 15 September 2026 sebagai batas waktu bagi perusahaan AI untuk memisahkan crawler web mereka ke dalam kategori yang berbeda dan teridentifikasi berdasarkan bagaimana konten yang di-crawl akan digunakan. Setiap crawler yang tidak mendeklarasikan tujuannya dengan jelas — atau yang menggabungkan pengindeksan pencarian dengan pelatihan AI dalam satu user-agent — akan diblokir secara default pada lalu lintas yang berasal dari Cloudflare, terutama di halaman yang menampilkan iklan .
Setelah tanggal tersebut, pelanggan baru Cloudflare dan situs web yang baru dibuat akan memiliki pengaturan default yang hanya mengizinkan crawler pencarian yang teridentifikasi dengan jelas, sambil memblokir crawler pelatihan AI dan agen AI kecuali publisher secara eksplisit memilih untuk mengizinkannya . Pelanggan lama di paket gratis yang tidak memperbarui preferensi mereka secara manual juga akan dialihkan ke pengaturan default yang baru
.
Sebelumnya, web beroperasi dengan norma opt-out: crawler diizinkan kecuali sebuah situs secara eksplisit memblokirnya melalui robots.txt. Cloudflare membalikkan ini menjadi paradigma opt-in untuk crawler khusus AI .
Cloudflare memperkenalkan klasifikasi baru yang memungkinkan publisher menetapkan aturan independen untuk tiga perilaku bot, tersedia untuk semua pelanggan termasuk pengguna paket gratis :
| Kategori | Definisi | Pengaturan Default (15 Sept) |
|---|---|---|
| Search | Crawler yang mengindeks konten agar muncul di hasil pencarian dan mengirimkan lalu lintas rujukan (referral traffic) kembali ke publisher. | Diizinkan secara default — bot ini mendatangkan pembaca dan pendapatan iklan. |
| Agent | Bot yang bertindak atas nama pengguna (misalnya, asisten AI yang melakukan tugas, berbelanja, atau memesan). | Diblokir secara default — publisher harus memilih untuk mengizinkan. |
| Training | Bot yang scraping konten semata-mata untuk melatih model AI, tanpa mengirimkan kembali pengguna atau atribusi. | Diblokir secara default — publisher harus memilih untuk mengizinkan. |
Publisher kini dapat menetapkan kebijakan seperti 'Izinkan Search, Blokir Training, Blokir Agent' dari satu dasbor, bahkan di paket gratis . Ini jauh lebih rinci daripada
robots.txt tradisional yang hanya mengizinkan izin atau larangan menyeluruh per user-agent. Dokumentasi Cloudflare sendiri mendefinisikan Search sebagai aktivitas di mana pemilik situs 'harus mengharapkan lalu lintas rujukan atau kompensasi yang adil lainnya' .
Cloudflare pertama kali memperkenalkan Pay Per Crawl pada Juli 2025 sebagai beta pribadi — sebuah pasar di mana publisher dapat menagih perusahaan AI per permintaan, menggunakan kode status HTTP 402 ('Payment Required') untuk menegosiasikan akses . Sistem ini memungkinkan publisher untuk mengembalikan respons 402 dengan informasi harga ketika crawler yang tidak disetujui meminta konten
.
Pada April 2026, selama yang disebut Cloudflare sebagai Agents Week (13-17 April), perusahaan mengembangkan ini menjadi model Pay Per Use yang lebih luas, menggabungkan kerangka kerja per-crawl ke dalam konsol operator tunggal yang tersedia di semua tingkatan paket . Perbedaan utamanya:
Implementasi Stack Overflow (Februari 2026) mendemonstrasikan versi produksi: program lisensi data mereka menggunakan kategorisasi bot Cloudflare untuk menyajikan respons 402 kepada crawler yang tidak sah, memonetisasi dalam skala besar tanpa kontrak khusus .
robots.txt yang melampaui akses tingkat halaman, memungkinkan publisher untuk memberi sinyal apakah konten mereka dapat digunakan untuk pengindeksan pencarian, pelatihan AI, atau agen AI Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Mulai 15 September 2026, Cloudflare akan memblokir semua crawler AI 'campuran' (mixed use) secara default di halaman yang menampilkan iklan, memaksa perusahaan AI seperti Google untuk memisahkan crawler pencarian, pel...
Mulai 15 September 2026, Cloudflare akan memblokir semua crawler AI 'campuran' (mixed use) secara default di halaman yang menampilkan iklan, memaksa perusahaan AI seperti Google untuk memisahkan crawler pencarian, pel... Cloudflare memperkenalkan sistem tiga kategori baru (Search, Agent, Training) yang memungkinkan publisher mengatur izin akses secara independen untuk setiap jenis bot, bahkan di paket gratis sekalipun.
Model 'Pay Per Crawl' berevolusi menjadi 'Pay Per Use', memberikan fleksibilitas bagi publisher untuk menetapkan tarif lisensi, biaya per crawl, atau akses berlangganan bagi perusahaan AI yang ingin melatih model mereka.