Estimasi lebih dari 10% dari Evan Hubinger adalah penilaian pribadi, bukan kebijakan Anthropic atau konsensus ilmiah. Perdebatan utamanya bukan bahwa model AI saat ini segera membawa bencana—Hubinger menilai risikonya rendah—melainkan apakah pengembangan boleh dipercepat menuju sistem yang dapat meningkatkan dirinya...
Diterbitkan olehDiedit dengan GPT-5.6 TerraGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Pernyataan publik Evan Hubinger tidak membuktikan bahwa AI akan menyebabkan kepunahan manusia. Namun, pernyataan itu mengungkap sesuatu yang lebih spesifik—dan penting: pemimpin alignment science atau riset penyelarasan di Anthropic tersebut secara pribadi menilai kemungkinan itu lebih dari 10% dalam satu dekade. Ia juga mengatakan Anthropic belum memiliki rencana untuk menyelesaikan penyelarasan superinteligensi, maupun jalur yang jelas menuju solusi tersebut. 1
2
Kombinasi inilah yang memberi bobot baru pada alasan pengunduran diri Jacob Coxon, mantan peneliti Anthropic dan OpenAI. Kekhawatirannya: laboratorium AI terdepan terus mendorong kemampuan sistem ke tingkat yang jauh lebih tinggi, sementara metode untuk menjaga sistem tersebut tetap selaras dengan maksud manusia belum terbukti berhasil. 2
3
Angka “lebih dari 10%” adalah penilaian Hubinger sendiri. Angka itu tidak disampaikan sebagai estimasi probabilitas resmi Anthropic, kesepakatan seluruh staf, atau ramalan ilmiah yang telah mapan. 1
2
Pembedaan ini penting. Sebuah estimasi probabilitas, sendirian, tidak menjelaskan mekanisme terjadinya bencana, tidak menetapkan kapan hal itu akan terjadi, dan tidak membuktikan bahwa bencana tersebut kemungkinan besar akan terjadi. Hubinger juga dilaporkan menyatakan risiko dari model yang tersedia saat ini rendah. Kekhawatirannya tertuju pada sistem masa depan yang jauh lebih kapabel, termasuk kemungkinan recursive self-improvement: AI memakai kemampuannya sendiri untuk membantu menciptakan AI yang lebih canggih. 2
10
Namun, pernyataan itu tetap menonjol karena datang dari orang yang memimpin pekerjaan penyelarasan di sebuah perusahaan AI terdepan. Pokok persoalannya bukan sekadar angka yang mengejutkan, melainkan kesenjangan antara kemajuan kemampuan AI dan keyakinan bahwa sistem supercerdas dapat tetap berada di bawah kendali manusia. 1
2
Coxon mengundurkan diri setelah menyatakan bahwa Anthropic maupun OpenAI tidak bertindak secara bertanggung jawab dan keduanya berlomba menuju superinteligensi yang mampu meningkatkan diri. Hubinger secara terbuka menyetujui poin Coxon bahwa orang-orang yang membangun sistem ini sungguh-sungguh memandang kemungkinan hasil setingkat kepunahan sebagai sesuatu yang nyata. 2
3
Ini tidak berarti semua karyawan memiliki pandangan yang sama, dan tidak menjadikan uraian Coxon sebagai penilaian independen yang telah terverifikasi atas kedua perusahaan. Tetapi, dukungan dari pemimpin penyelarasan yang masih aktif membuat pengunduran diri Coxon lebih sulit dianggap sebagai keluhan tunggal dari mantan pegawai. Kekhawatiran serius di dalam perusahaan, ternyata, dapat berjalan beriringan dengan pengembangan AI terdepan yang terus berlanjut. 1
2
Komentar Samuel Marks juga perlu dibaca dengan kehati-hatian yang sama. Ia dilaporkan mengatakan pengembang AI memandang teknologi mereka dapat menyebabkan kepunahan manusia atau dampak yang sama parahnya. Akan tetapi, itu adalah pandangan orang dalam, bukan bukti mengenai estimasi risiko yang berlaku untuk seluruh perusahaan. 5
Peristiwa ini kerap disederhanakan menjadi “AI kiamat” melawan “AI optimistis”. Pertanyaan yang lebih berguna justru praktis: pengaman apa yang harus diwajibkan ketika potensi dampaknya berskala global dan tak dapat dipulihkan, sementara peluang serta waktunya masih sangat tidak pasti?
Pernyataan Hubinger mempertajam beberapa isu berikut:
Poin-poin tersebut adalah persoalan tata kelola, bukan bukti bahwa bencana sudah di depan mata. Namun, persoalan seperti inilah yang jauh lebih sulit diselesaikan setelah suatu sistem memperoleh kemampuan berbahaya.
Sejumlah laporan menyebut Anthropic tidak menyerahkan model terbarunya kepada UK AI Safety Institute untuk diuji sebelum dirilis. Klaim itu harus diperlakukan secara hati-hati: laporan yang tersedia menggambarkannya sebagai pemberitaan, bukan temuan publik yang telah dikonfirmasi oleh Anthropic atau pemerintah Inggris. 10
Meski demikian, tudingan tersebut menggambarkan alasan komitmen keselamatan sukarela sering dipandang skeptis. Jika pemimpin keselamatan perusahaan sendiri mengakui masalah penyelarasan belum terselesaikan, pengamat luar wajar bertanya: pengujian apa yang dilakukan, siapa yang meninjaunya, hasil apa yang dibagikan, dan pada ambang kemampuan seperti apa pengendalian yang lebih ketat diberlakukan?
Seruan untuk “memperlambat” tidak harus berarti menghentikan seluruh riset atau penerapan AI secara permanen. Argumen kebijakannya adalah membangun pemeriksaan yang dapat ditegakkan sebelum sistem melewati ambang kemampuan yang berkonsekuensi besar.
Langkah yang kerap dibahas mencakup:
Logikanya sederhana: jika risikonya belum pasti tetapi dampak buruknya berpotensi ekstrem, pengaman harus dapat dibuktikan sebelum—bukan setelah—kendali hilang.
Unggahan Hubinger memperlihatkan ketegangan di pusat industri AI terdepan: pengembang dapat mengakui secara terbuka adanya risiko jangka panjang yang sangat serius, sambil tetap membangun menuju kemampuan yang membuat risiko itu semakin mendesak. 1
2
Pernyataan tersebut tidak menyelesaikan pertanyaan tentang peluang bencana AI, dan tidak seharusnya diperlakukan sebagai prediksi resmi Anthropic. Namun, ia membuat perdebatan penyelarasan AI menjadi lebih konkret. Pertanyaannya bukan lagi hanya apakah AI yang sangat canggih dapat menjadi berbahaya, melainkan apakah perusahaan dan pemerintah dapat menunjukkan—melalui bukti independen, aturan yang dapat ditegakkan, dan koordinasi internasional—bahwa mereka siap sebelum sistem yang dimaksud menjadi terlalu kuat untuk diatur dengan aman. 1
10
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Estimasi lebih dari 10% dari Evan Hubinger adalah penilaian pribadi, bukan kebijakan Anthropic atau konsensus ilmiah.
Estimasi lebih dari 10% dari Evan Hubinger adalah penilaian pribadi, bukan kebijakan Anthropic atau konsensus ilmiah. Perdebatan utamanya bukan bahwa model AI saat ini segera membawa bencana—Hubinger menilai risikonya rendah—melainkan apakah pengembangan boleh dipercepat menuju sistem yang dapat meningkatkan dirinya sendiri sebelum p...
Kasus ini menggeser fokus perdebatan ke transparansi perusahaan, pengujian independen, aturan yang dapat ditegakkan, dan koordinasi internasional; bukan sekadar pertarungan antara optimisme dan pesimisme terhadap AI.