Anthropic merilis Claude Fable 5 (model umum untuk publik) dan Claude Mythos 5 (model yang sama tetapi dengan pengaman siber dilepas, dikhususkan untuk pembela siber yang telah terverifikasi) pada 9–10 Juni 2026 .
Pada 12 Juni 2026 pukul 17.21 ET, Departemen Perdagangan AS mengeluarkan arahan pengendalian ekspor darurat yang memerintahkan Anthropic untuk segera menonaktifkan kedua model tersebut untuk setiap warga negara asing, termasuk karyawan asing Anthropic sendiri . Anthropic mematuhi arahan tersebut pada hari yang sama dengan menangguhkan akses secara global
.
Penyebabnya: Peneliti keamanan siber, Katie Moussouris, mendemonstrasikan bahwa model-model tersebut dapat disuruh dengan perintah tiga kata sederhana, "Fix this code" (Perbaiki kode ini), untuk secara otonom merekayasa balik dan mempersenjatai celah keamanan perangkat lunak, sehingga memicu alarm keamanan nasional . Amazon, investor Anthropic, memperingatkan Gedung Putih setelah tinjauan keamanan internal mereka
.
Pada April 2026, Anthropic menyelidiki tuduhan bahwa sekelompok kecil orang telah mendapatkan akses tidak sah ke model pratinjau Claude Mythos sebelumnya—sebuah sistem yang oleh Anthropic sendiri digambarkan terlalu kuat untuk dirilis ke publik . Insiden ini menjadi pertanda kekhawatiran yang lebih luas tentang risiko penyebaran yang kemudian memicu penghentian Fable 5.
OpenAI meluncurkan Daybreak, sebuah inisiatif keamanan siber besar-besaran, pada 11 Mei 2026—hari yang sama ketika Threat Intelligence Group Google mengungkapkan kasus pertama yang dikonfirmasi di mana penyerang menggunakan AI untuk membangun eksploitasi zero-day . Daybreak menggabungkan tingkatan model GPT-5.5 (termasuk varian 'GPT-5.5-Cyber' untuk red-teaming) dengan agen Codex Security dan lebih dari 20 mitra keamanan (Cloudflare, CrowdStrike, Palo Alto Networks, dll.) untuk mengotomatiskan penemuan kerentanan, validasi tambalan, dan perbaikan dengan kecepatan mesin
. Peluncuran ini dipandang sebagai respons kompetitif langsung OpenAI terhadap penawaran Project Glasswing / Mythos milik Anthropic
.
Pada 1 Mei 2026, enam badan keamanan siber di seluruh Five Eyes (CISA, NSA, ASD ACSC, CCCS, NZ NCSC, UK NCSC) menerbitkan "Careful Adoption of Agentic AI Services" —ini adalah panduan keamanan bersama pertama yang secara khusus menargetkan agen AI otonom . Panduan ini mengidentifikasi lima kategori risiko (hak istimewa, desain/konfigurasi, perilaku, akuntabilitas, dan data/operasional) dan memperingatkan bahwa agen otonom yang 'bertindak, memutuskan, dan berinteraksi lintas sistem dengan cara yang sulit diprediksi, diaudit, atau dikendalikan' sudah beroperasi di infrastruktur kritis dengan pengamanan yang tidak memadai
. Panduan Mei ini menjadi landasan kebijakan yang kemudian ditingkatkan oleh pernyataan 22 Juni menjadi seruan bertindak yang lebih luas dan mendesak.
Panduan agentic AI di bulan Mei mengidentifikasi risiko sistemik. Insiden akses ke Mythos dan kerentanan 'Fix this code' di Fable 5 membuktikan bahwa risiko tersebut sudah terwujud di model-model canggih dunia nyata. Peluncuran Daybreak oleh OpenAI memperkuat dinamika kompetitif dan keamanan. Pernyataan 22 Juni merupakan kesimpulan terpadu Five Eyes bahwa jendela waktu untuk tindakan pertahanan telah runtuh dari tahunan menjadi hitungan bulan.