Laporan menyatakan Anthropic tidak menyerahkan Claude Mythos 5.1 kepada UK AI Security Institute (AISI) untuk ujian pra-pelancaran. Ini dilaporkan sebagai kali pertama AISI dikecualikan daripada penilaian model AI hadapan Anthropic. Namun, fakta yang dapat dipastikan hanyalah keputusan akses tersebut: Anthropic belum menyatakan secara terbuka mengapa AISI tidak diberi akses.
3
4
Apa yang diketahui setakat ini
Mythos 5.1 dilancarkan pada 1 September 2026. Aksesnya dilaporkan terhad kepada organisasi AS yang diluluskan dan telah disaring menerusi Project Glasswing, manakala AISI tidak menerima model itu sebelum pelancaran.
3
4
Pendekatan akses terhad ini sejajar dengan penerangan Anthropic sendiri. Syarikat itu menyatakan Mythos 5.1 hanya tersedia kepada sekumpulan kecil organisasi yang telah disaring untuk penyelidikan keselamatan siber dan biologi, manakala nota keluaran platformnya menyenaraikan model tersebut untuk peserta Project Glasswing.
49
52
Rekod awam tidak menunjukkan bahawa kerajaan AS mengarahkan Anthropic menolak akses AISI, atau bahawa undang-undang mewajibkan keputusan itu. Penjelasan yang mungkin—seperti langkah berhati-hati terhadap kawalan eksport, kepekaan keupayaan siber dan sains hayat, kerahsiaan komersial, atau dasar akses dipercayai yang berfokus kepada AS—masih belum disahkan.
Mythos 5.1 berbanding Fable 5.1
Perbezaan utama bukanlah model asas yang berasingan. Anthropic menyifatkan Fable 5.1 dan Mythos 5.1 sebagai model yang sama, tetapi dengan tahap perlindungan yang berbeza.
63
| Model |
Ketersediaan |
Kegunaan dan perlindungan |
| Claude Fable 5.1 |
Tersedia secara umum melalui produk dan platform awan yang disokong Anthropic |
Untuk penaakulan kompleks, pengekodan, penyelidikan dan kerja ejen jangka panjang. 49 50 |
| Claude Mythos 5.1 |
Terhad kepada organisasi yang telah disaring melalui program akses dipercayai |
Direka bagi kerja keselamatan siber dan sains hayat, dengan pengedaran yang lebih terkawal. 52 63 |
Dalam penerangan terdahulu tentang pemisahan Mythos/Fable, Anthropic menyatakan versi Mythos yang terhad menggunakan model asas sama seperti Fable, tetapi beberapa perlindungan dalam bidang tertentu telah dilonggarkan untuk kumpulan kecil pertahanan siber dan penyedia infrastruktur.
53
Kedua-dua model 5.1 menyokong tetingkap konteks satu juta token dan output sehingga 128,000 token, menurut nota keluaran Anthropic.
49
Mengapa pengecualian AISI penting
AISI ialah organisasi penyelidikan kerajaan UK yang menguji sistem AI terkemuka, memberi maklumat kepada penggubal dasar, serta membangunkan dan menilai langkah mengurangkan risiko.
38 Institut itu mempunyai lebih 100 kakitangan teknikal dan telah menguji lebih 30 model AI maju.
36
37
Namun, akses AISI bergantung pada kerjasama pembangun model. Jika pembangun tidak menyerahkan model terhad untuk dinilai, penguji kerajaan yang bebas tidak dapat menilai secara langsung profil keupayaannya, laluan penyalahgunaan atau keberkesanan kawalannya sebelum model digunakan. Ini bukan bukti bahawa model itu tidak selamat; ia ialah jurang dalam bukti yang tersedia kepada pembuat dasar.
Isunya lebih ketara bagi penggunaan berkaitan siber dan biologi, kerana ujian sering perlu dilakukan dalam keadaan yang realistik, bukan hanya bergantung pada penilaian dalaman syarikat. AISI menyatakan skop tugasnya termasuk menilai risiko kepada keselamatan negara dan keselamatan awam, serta memajukan kaedah perlindungan, penjajaran dan kawalan.
41
46
Kebimbangan tentang unsur perlindungan pasaran
Pegawai UK dilaporkan bimbang keputusan itu mungkin menandakan kecenderungan perlindungan pasaran yang lebih luas dalam kalangan pembangun AI AS.
3
4 Kebimbangan itu berkait dengan hakikat bahawa akses kepada model berkeupayaan tinggi menentukan pihak yang boleh menilainya, membina aplikasi pertahanan, dan membentuk bukti yang digunakan dalam dasar awam.
Namun, tafsiran geopolitik itu perlu dipisahkan daripada fakta yang telah disahkan. Program akses dipercayai yang ketat juga boleh mencerminkan kebimbangan keselamatan dan penyalahgunaan, selain strategi negara atau komersial. Tanpa penjelasan Anthropic, tiada asas untuk menyimpulkan bahawa keputusan itu berpunca daripada arahan dasar AS atau membuktikan wujudnya perlindungan pasaran yang diselaraskan.
Pendirian awam kerajaan UK menekankan bahawa ia terus bekerjasama dengan rakan industri, termasuk Anthropic.
11 AISI juga terus menilai sistem AI hadapan lain; sebagai contoh, ia telah menerbitkan kerja penilaian siber terhadap GPT-5.5 milik OpenAI.
42
Amaran keselamatan menaikkan kepentingan isu, bukan menjelaskan motif
Pertikaian akses ini berlaku ketika perdebatan tentang risiko model AI hadapan semakin memuncak. Bahan diterbitkan Anthropic mengakui AISI menilai konfigurasi keselamatan siber Mythos 5 terdahulu, apabila perlindungan biasa dialihkan dan akses internet sengaja diberikan. Laporan risiko Anthropic menyatakan AISI mendapati aktiviti berterusan yang berpotensi memudaratkan, ditujukan kepada individu dan organisasi sebenar, dalam penilaian itu.
9
Secara berasingan, bekas penyelidik Anthropic Jacob Coxon meletak jawatan dan memberi amaran tentang hala tuju AI maju. Penyelidik penjajaran Anthropic, Evan Hubinger, kemudian menyatakan anggaran peribadinya bahawa kebarangkalian AI membunuh semua manusia dalam tempoh sedekad melebihi 10%. Itu ialah ramalan peribadi, bukannya penilaian rasmi Anthropic terhadap model semasa atau bukti bahawa Mythos 5.1 membawa risiko sedemikian.
19
32
Kesimpulan yang lebih dekat dan disokong bukti adalah lebih terhad: apabila sebuah model direka untuk kerja sensitif dalam keselamatan siber dan sains hayat, serta diedarkan melalui program yang sangat dikawal, penilaian bebas menjadi lebih bernilai. Mengecualikan penilai luar yang berkeupayaan mewujudkan jurang dalam asas bukti untuk kerajaan dan orang awam.
Kesimpulan
Keputusan Anthropic untuk tidak memberikan Mythos 5.1 kepada AISI didokumenkan dalam laporan, tetapi sebabnya tidak diketahui. Kesimpulan paling kukuh ialah penilai bebas utama dari UK tidak menerima akses pra-pelancaran kepada versi terhad model terbaharu Anthropic, walaupun organisasi AS yang telah disaring menerimanya.
3
4
Hal itu tidak membuktikan Mythos 5.1 tidak selamat, menyalahi undang-undang, atau disekat atas arahan kerajaan AS. Namun, ia menunjukkan bagaimana aturan akses secara sukarela boleh mengehadkan semakan bebas tepat ketika versi model yang dipersoalkan ditujukan untuk aplikasi paling sensitif.