Anggaran melebihi 10% oleh Evan Hubinger ialah pandangan peribadi, bukannya dasar Anthropic atau konsensus saintifik. Isu utamanya bukan bahawa model AI semasa pasti membawa bencana—Hubinger menyifatkan risikonya rendah—tetapi sama ada pembangunan perlu dipercepatkan ke arah sistem yang boleh memperbaik diri sebelum...
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Kenyataan terbuka Evan Hubinger tidak membuktikan bahawa AI akan menyebabkan kepupusan manusia. Namun, ia membawa maksud yang lebih khusus—dan luar biasa penting: ketua sains keselarasan Anthropic itu berkata beliau secara peribadi menganggarkan kemungkinan tersebut melebihi 10% dalam tempoh sedekad, sambil mengakui Anthropic masih belum mempunyai pelan untuk menyelesaikan keselarasan bagi superkecerdasan, atau laluan jelas ke arah penyelesaiannya. 1
2
Gabungan dua perkara itu menguatkan kebimbangan yang dibangkitkan oleh bekas penyelidik Anthropic dan OpenAI, Jacob Coxon, ketika beliau meletak jawatan: makmal AI perintis mungkin terus mengejar sistem yang jauh lebih berkeupayaan, sedangkan kaedah untuk memastikan sistem itu kekal mematuhi niat manusia belum terbukti. 2
3
Angka “melebihi 10%” itu ialah penilaian Hubinger sendiri. Ia tidak dibentangkan sebagai anggaran kebarangkalian rasmi Anthropic, persetujuan bersama kakitangannya atau ramalan saintifik yang muktamad. 1
2
Kelayakan ini penting. Sesuatu anggaran kebarangkalian tidak dengan sendirinya menghuraikan mekanisme, menetapkan garis masa atau membuktikan malapetaka itu berkemungkinan besar. Hubinger juga dilaporkan berkata risiko daripada model yang tersedia hari ini adalah rendah. Kebimbangan beliau tertumpu pada kemungkinan sistem masa depan menjadi jauh lebih berkeupayaan, termasuk melalui penambahbaikan kendiri berulang—apabila keupayaan AI digunakan untuk membantu membina AI yang lebih berkeupayaan. 2
10
Namun begitu, kenyataan itu menonjol kerana ia datang daripada individu yang mengetuai kerja keselarasan di sebuah makmal AI perintis utama. Pendedahan terasnya bukan semata-mata angka yang menggemparkan, sebaliknya jurang antara kemajuan keupayaan AI dengan keyakinan bahawa sistem supercerdas boleh terus dikawal manusia. 1
2
Coxon, yang pernah bekerja di OpenAI dan Anthropic, meletak jawatan sambil berhujah bahawa kedua-dua syarikat tidak bertindak secara bertanggungjawab dan sedang berlumba ke arah superkecerdasan yang boleh memperbaik dirinya sendiri. Hubinger secara terbuka bersetuju dengan dakwaan Coxon bahawa pihak yang membina sistem ini benar-benar menganggap kemungkinan kesan setaraf kepupusan sebagai sesuatu yang nyata. 2
3
Ini tidak membuktikan semua pekerja berkongsi pandangan yang sama, dan tidak menjadikan kenyataan Coxon sebagai penilaian bebas yang disahkan terhadap kedua-dua syarikat. Namun, ia menjadikan amaran peletakan jawatan itu lebih sukar diketepikan sebagai rungutan terpencil daripada bekas pekerja. Seorang pemimpin keselarasan yang masih berkhidmat mengesahkan perkara asasnya: kebimbangan dalaman yang serius boleh wujud serentak dengan pembangunan AI perintis yang berterusan. 1
2
Komen berkaitan daripada Samuel Marks juga wajar dibaca dengan cermat. Laporan menyifatkan beliau sebagai berkata bahawa pembangun AI percaya teknologi mereka boleh menyebabkan kepupusan manusia atau kesan buruk yang sama serius, tetapi ini ialah pandangan orang dalam—bukan bukti anggaran risiko seluruh syarikat yang telah diterbitkan. 5
Episod ini sering diringkaskan secara keterlaluan sebagai “AI membawa maut” lawan “AI membawa manfaat”. Soalan yang lebih berguna adalah praktikal: apakah perlindungan yang perlu diwajibkan apabila kemudaratan berpotensi bersifat global serta tidak boleh dipulihkan, tetapi kebarangkalian dan garis masanya masih sangat tidak pasti?
Kenyataan Hubinger menajamkan beberapa isu:
Ini ialah masalah tadbir urus, bukannya bukti bahawa bencana akan berlaku dalam masa terdekat. Namun, masalah seperti inilah yang mungkin menjadi jauh lebih sukar diselesaikan selepas sistem memperoleh keupayaan berbahaya.
Laporan menyebut Anthropic enggan menyerahkan model terbaharunya kepada Institut Keselamatan AI United Kingdom untuk diuji sebelum pelancaran. Perkara ini perlu ditanggapi dengan berhati-hati: laporan yang ada menggambarkannya sebagai dakwaan laporan media, bukan dapatan awam yang telah disahkan oleh syarikat atau kerajaan United Kingdom. 10
Walaupun begitu, dakwaan tersebut menggambarkan mengapa komitmen keselamatan secara sukarela boleh mengundang skeptisisme. Jika pemimpin keselamatan syarikat sendiri mengakui cabaran keselarasan belum selesai, pemerhati luar wajar bertanya: ujian apa yang dibuat, siapa yang menyemaknya, keputusan apa yang dikongsi, dan pada tahap keupayaan mana kawalan lebih ketat diwajibkan?
Seruan supaya “memperlahankan” pembangunan tidak semestinya bermakna menghentikan semua penyelidikan atau penggunaan AI selama-lamanya. Hujah dasar yang lebih khusus ialah mewujudkan semakan yang boleh dikuatkuasakan sebelum sistem melepasi ambang keupayaan yang sangat berbangkit.
Antara langkah yang boleh dipertimbangkan ialah:
Logiknya mudah: jika risiko masih tidak pasti tetapi kesan buruknya boleh menjadi amat besar, perlindungan mesti dapat dibuktikan sebelum, bukan selepas, kawalan hilang.
Catatan Hubinger menonjolkan satu ketegangan di pusat pembangunan AI perintis: pembangun utama boleh mengakui secara terbuka risiko jangka panjang yang parah, sambil terus membina ke arah keupayaan yang menjadikan risiko tersebut semakin mendesak. 1
2
Ia tidak menentukan kebarangkalian sebenar kemudaratan AI yang membawa bencana, dan tidak patut dianggap sebagai ramalan rasmi Anthropic. Tetapi ia menjadikan perbahasan keselarasan AI lebih nyata. Persoalannya bukan lagi semata-mata sama ada AI canggih mungkin menjadi berbahaya. Persoalannya ialah sama ada syarikat dan kerajaan boleh menunjukkan—melalui bukti bebas, peraturan yang boleh dikuatkuasakan dan penyelarasan antarabangsa—bahawa mereka sudah bersedia sebelum sistem berkenaan menjadi terlalu berkuasa untuk ditadbir dengan selamat. 1
10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anggaran melebihi 10% oleh Evan Hubinger ialah pandangan peribadi, bukannya dasar Anthropic atau konsensus saintifik.
Anggaran melebihi 10% oleh Evan Hubinger ialah pandangan peribadi, bukannya dasar Anthropic atau konsensus saintifik. Isu utamanya bukan bahawa model AI semasa pasti membawa bencana—Hubinger menyifatkan risikonya rendah—tetapi sama ada pembangunan perlu dipercepatkan ke arah sistem yang boleh memperbaik diri sebelum kaedah kawalan ya...
Episod ini mengalihkan tumpuan perdebatan kepada ketelusan syarikat, penilaian bebas, peraturan yang boleh dikuatkuasakan dan penyelarasan antarabangsa, bukan sekadar pertembungan antara optimisme dengan pesimisme AI.