Anthropic berkata ia mengesan dan mengganggu cubaan salah guna Claude Haiku, Sonnet dan Opus dari Disember 2025 hingga Ogos 2026 dalam tujuh bidang ancaman, termasuk senjata, pengawasan, biologi dan penyulingan model. Isu utamanya ialah AI berkeupayaan tinggi boleh mengurangkan masa, tenaga kerja dan kepakaran yang...
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic’s 154-page September 10, 2026 threat-intelligence report reveal about adversaries’ eight-month misuse of its Claude Haiku. Article summary: Anthropic’s report documented attempted misuse—not verified successful deployment—of older Claude Haiku, Sonnet, and Opus models across seven harm areas from December 2025 through August 2026. Its core warning was that f. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Anthropic menerbitkan laporan risikan ancamannya pada 10 September 2026, yang menghuraikan operasi dipercayai telah dikenal pasti dan diganggu sepanjang lapan bulan, dari Disember 2025 hingga Ogos 2026. Kes-kes itu membabitkan cubaan menyalahgunakan Claude Haiku, Sonnet dan Opus bagi operasi siber, operasi pengaruh, pengawasan, penipuan dan scam, salah guna biologi, pembangunan senjata konvensional serta penyulingan model secara haram. 16
Pembezaan ini penting: laporan tersebut merekodkan cubaan mendapatkan bantuan AI, bukannya pengesahan bahawa projek senjata, pengawasan atau biologi yang didakwa itu benar-benar digunakan di lapangan atau berjaya disiapkan. Anthropic turut menegaskan bahawa kes yang dikongsikan ialah contoh terpilih, bukannya gambaran penggunaan Claude yang lazim. 16
Amaran utama Anthropic ialah model AI maju boleh mengurangkan keperluan terhadap pengetahuan khusus, masa dan tenaga kerja untuk menjalankan aktiviti yang memudaratkan. Dalam kes yang didedahkan, pelaku dipercayai meminta bantuan bagi tugasan daripada penyelidikan dan pembangunan perisian hingga bahan penyasaran serta analisis operasi. 1
16
Antara dakwaan paling serius ialah cubaan menggunakan Claude bagi menyokong kerja berkaitan senjata konvensional dan pengawasan. Laporan media mengenai pendedahan itu menyebut usaha yang dikaitkan dengan perisian dron serangan sehala autonomi, sistem navigasi peluru berpandu dan aplikasi ketenteraan yang melibatkan pelaku berkait dengan Rusia, Iran, China dan Yaman. 1
Bahan kes itu juga merangkumi dakwaan usaha mengenal pasti serta menyasarkan warga Uyghur melalui WhatsApp dan Telegram, selain sistem pengawasan telekomunikasi berskala besar di Mali. Contoh-contoh ini menunjukkan kebimbangan lebih luas Anthropic: model AI bukan sekadar boleh digunakan untuk menjana kod, malah untuk penyelidikan, pengelasan, analisis dan penyediaan dokumen operasi. 1
16
Anthropic mengenal pasti lima kes salah guna biologi. Salah satunya melibatkan cubaan yang berkait dengan usaha meningkatkan kebolehjangkitan virus bawaan nyamuk, menurut laporan mengenai dokumen itu. 1
Syarikat itu juga berkata ada pengguna yang mencari sistem AI pesaing selepas Claude menolak permintaan sensitif. Ini tidak membuktikan cubaan tersebut berjaya di tempat lain, tetapi menunjukkan batas kawalan pada peringkat penyedia: penolakan oleh satu perkhidmatan boleh mengganggu aktiviti, tanpa semestinya menghapuskan pilihan pelaku untuk mencari alternatif. 1
Bahagian lain laporan itu menumpukan penyulingan model haram, iaitu penggunaan output model yang lebih berkeupayaan untuk membantu melatih sistem lain. Anthropic mengaitkan kempen tersebut dengan tujuh makmal berpangkalan di China, termasuk Alibaba, Moonshot dan DeepSeek. Ia turut menerangkan penggunaan banyak akaun serta arahan yang disampaikan secara berantai untuk memperoleh output atau penaakulan model yang berguna. 1
Penyalahgunaan ini berbeza daripada pembangunan senjata atau pengawasan, tetapi tetap menimbulkan kebimbangan strategik kepada pembangun AI. Akses kepada model boleh dieksploitasi untuk meniru keupayaan dan berpotensi mengelakkan kos membangunkan keupayaan tersebut secara bebas.
Anthropic berkata kes salah guna yang dilaporkan melibatkan Claude Haiku, Sonnet dan Opus. Menurutnya, tiada kes melibatkan kelas model Fable atau Mythos yang lebih baharu, kecuali satu kes penyulingan haram. 12
16
Pengecualian itu penting kerana ia membetulkan dakwaan terlalu umum bahawa Fable dan Mythos langsung tidak muncul dalam laporan. Kesimpulan yang lebih tepat ialah kedua-duanya tidak digunakan dalam kes salah guna yang didedahkan, selain pengecualian penyulingan tersebut. 12
Anthropic berkata ia mengganggu operasi berkenaan, menyekat akaun yang terlibat, memperkukuh pertahanan, dan apabila sesuai, berkongsi maklumat dengan pihak berkuasa serta rakan industri. 16
Namun, laporan itu ialah akaun yang dihasilkan syarikat berdasarkan aktiviti yang diperhatikan pada platformnya sendiri. Ia merupakan bukti yang bernilai tentang perkara yang dikesan dan ditangani Anthropic, tetapi tidak patut dibaca sebagai pengesahan bebas bahawa setiap pelaku yang didakwa berjaya menyempurnakan projek mereka. Anthropic sendiri membingkaikan laporan itu sebagai himpunan kes penting, bukan tinjauan yang mewakili semua bentuk salah guna. 16
Dua hari selepas laporan itu diterbitkan, Ketua Pegawai Eksekutif Anthropic, Dario Amodei, menerbitkan esei We Must Pace the Frontier. Beliau berhujah bahawa syarikat AI patut sengaja memperlahankan kadar peningkatan keupayaan model sempadan—iaitu model paling maju—sambil meneruskan kemajuan teknikal, supaya penyelarasan, perlindungan dan pengesahan keselamatan dapat mengejar langkahnya. 25
Cadangan Amodei bukan seruan untuk menghentikan latihan model. Komitmen konkrit pertamanya ialah Anthropic akan memberi penilai pihak ketiga akses kekal pada tahap akses pekerja kepada sistemnya. Langkah itu bertujuan membolehkan mereka menilai amalan keselamatan, melaporkan insiden dan menilai penyelarasan model semasa latihan. 18
25
Cadangan tiga langkah beliau pula melibatkan pengawasan di peringkat syarikat, penyelarasan antara firma di negara demokrasi, dan akhirnya penyelarasan antarabangsa yang lebih luas. 23
25
Laporan itu membuktikan Anthropic berkata ia mengesan dan mengganggu cubaan penggunaan berniat jahat terhadap model Claude yang lebih lama dalam tempoh dinyatakan, merentasi tujuh kategori bahaya. Ia juga memberi asas yang jelas kepada pendirian syarikat bahawa kawalan keselamatan perlu berkembang seiring dengan keupayaan model. 16
Apa yang tidak dapat dibuktikan oleh pelaporan yang tersedia ialah laporan tersebut secara langsung menyebabkan tindakan tertentu oleh Kongres Amerika Syarikat, menamatkan tempoh rehat Dewan Perwakilan, atau menghasilkan larangan perundangan khusus terhadap “superintelligence”. Tekanan politik yang lebih luas untuk pengawasan keselamatan AI memang wujud, dan Amodei berhujah bahawa kerajaan perlu membantu memastikan keupayaan AI seimbang dengan keselamatan. Namun, dakwaan sebab-akibat yang khusus itu memerlukan bukti di luar bahan yang tersedia di sini. 25
27
Kesimpulan praktikalnya mungkin kurang sensasi, tetapi lebih penting: pencegahan salah guna AI bukan semata-mata soal model menolak arahan berbahaya. Ia memerlukan pemantauan terhadap penyalahgunaan yang diselaraskan, tindak balas terhadap pengelakan melalui akaun dan usaha penyulingan model, perkongsian risikan ancaman, serta penilaian keselamatan yang boleh dipercayai apabila keupayaan AI terus meningkat. 16
25
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anthropic berkata ia mengesan dan mengganggu cubaan salah guna Claude Haiku, Sonnet dan Opus dari Disember 2025 hingga Ogos 2026 dalam tujuh bidang ancaman, termasuk senjata, pengawasan, biologi dan penyulingan model.
Anthropic berkata ia mengesan dan mengganggu cubaan salah guna Claude Haiku, Sonnet dan Opus dari Disember 2025 hingga Ogos 2026 dalam tujuh bidang ancaman, termasuk senjata, pengawasan, biologi dan penyulingan model. Isu utamanya ialah AI berkeupayaan tinggi boleh mengurangkan masa, tenaga kerja dan kepakaran yang diperlukan untuk aktiviti berbahaya; larangan akaun pula mungkin hanya mengalihkan pelaku kepada penyedia lain.
Pendedahan itu mendahului seruan Ketua Pegawai Eksekutif Anthropic, Dario Amodei, untuk “memacukan sempadan” AI dengan lebih terkawal supaya kerja keselamatan dan penilaian bebas dapat mengejar kemajuan keupayaan.