OpenAI melancarkan GPT 6 Astra secara terhad pada 3 September, menyifatkannya sebagai model paling pintar dan paling sejajar setakat ini, serta model pertamanya yang dinilai “Kritikal” bagi keupayaan keselamatan siber. OpenAI melaporkan skor 98% bagi FrontierMath Tier 4, 99.9% bagi ARC AGI 3 dan 100% bagi ExploitBench.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
OpenAI mengumumkan GPT-6 Astra pada 3 September sebagai model untuk tugasan sukar yang memerlukan beberapa langkah—daripada pengekodan, penyelidikan dan penggunaan komputer hingga aliran kerja profesional. Syarikat itu menyifatkannya sebagai model paling pintar dan paling sejajar yang pernah dibangunkan, tetapi tidak membukanya terus kepada semua pengguna. Sebaliknya, akses awal diberikan kepada kumpulan organisasi yang terhad. 2
5
13
Pelancaran ini bukan sekadar tentang dakwaan peningkatan skor penanda aras. OpenAI turut menyatakan Astra ialah model pertama mereka yang mencapai tahap keupayaan keselamatan siber Kritikal di bawah Preparedness Framework. Justeru, dakwaan keupayaan model dan cara aksesnya dikawal perlu dinilai sebagai satu pakej. 10
12
Menurut OpenAI, Astra mencapai prestasi terbaik dalam penggunaan komputer, pelayaran web, kejuruteraan perisian, keselamatan siber, sains dan tugasan profesional. Dokumentasi pembangunnya menyasarkan model ini untuk penaakulan rumit, pengekodan, penggunaan komputer, penyelidikan serta pembinaan dokumen. 1
3
13
Antara keputusan penilaian utama yang diterbitkan OpenAI ialah:
Nombor ini ialah keputusan penilaian yang dilaporkan oleh OpenAI sendiri, bukannya pengukuran yang telah disahkan semula secara bebas. Skor tinggi boleh menunjukkan kemajuan bagi tugasan yang diuji, tetapi tidak dengan sendirinya membuktikan kecerdasan am, pertimbangan yang boleh diharap dalam situasi dunia sebenar, atau autonomi yang selamat untuk semua keadaan.
OpenAI menyatakan Astra ialah model pertama mereka yang mencapai tahap Kritikal bagi keupayaan keselamatan siber di bawah rangka kerja kesiapsiagaannya. Mengikut huraian syarikat itu, dengan alat dan akses yang sesuai, Astra boleh mengenal pasti kelemahan keselamatan yang belum diketahui sebelum ini serta membangunkan cara baharu untuk mengeksploitasinya merentasi banyak sistem yang dilindungi rapi—tanpa manusia perlu mengarahkannya pada setiap langkah. 10
12
Terdapat dua batas penting pada dakwaan ini:
OpenAI berkata ia menambah perlindungan lebih ketat terhadap tindakan siber yang memudaratkan, termasuk pemantauan tambahan sepanjang pelancaran Astra. 5
10 Keputusan untuk memperkenalkan akses secara berperingkat, bukannya membukanya kepada umum serta-merta, selari dengan risiko tambahan yang diakui syarikat itu.
OpenAI juga memanggil Astra modelnya yang paling sejajar, dengan dakwaan model itu lebih baik dalam mematuhi skop tugasan dan berkomunikasi secara telus. 2
13
Namun, istilah “sejajar” perlu dibaca dengan cermat. Dalam konteks pelancaran model, ia merujuk kepada prestasi di bawah kaedah latihan dan penilaian tertentu. Ia bukan jaminan bahawa ejen AI sentiasa memahami niat pengguna dengan tepat, tidak akan melangkaui semua sempadan operasi, atau boleh digunakan tanpa semakan manusia.
Nota pelancaran OpenAI sendiri menyebut pemantauan tambahan untuk mengenal pasti keadaan apabila ejen mungkin tersalah tafsir arahan pengguna. 5 Bagi organisasi yang mahu menggunakan ejen AI, persoalan praktikalnya bukan sekadar sama ada model dilabel “sejajar”, tetapi:
Bahan yang dibekalkan mengaitkan penjelasan susulan dengan sebahagian angka penilaian, termasuk kebimbangan tentang pencemaran penanda aras dan perbezaan antara konfigurasi akses khas dengan akses pengeluaran lalai.
Ia juga menghuraikan ujian yang mendapati pemantauan berdasarkan rantaian pemikiran sahaja kurang berkesan berbanding pemantauan yang menerima konteks lebih lengkap. Namun, petikan sumber utama yang tersedia tidak memberikan sejarah semakan lengkap yang boleh diaudit secara bebas bagi semua keputusan, atau metodologi pemantauan penuh.
Kesimpulan yang lebih bertanggungjawab ialah: angka utama penanda aras dan penilaian keselamatan perlu dianggap sebagai bukti pelancaran yang boleh berubah. Sebelum bergantung pada sesuatu skor atau dakwaan penggunaan, organisasi patut menyemak dokumentasi model dan bahan keselamatan terkini. 2
3
10
Pelancaran Astra berlaku selepas insiden ujian keselamatan melibatkan model OpenAI sebelum ini. OpenAI berkata kejadian itu mempengaruhi pendekatan keselamatannya terhadap Astra, sambil menegaskan Astra sendiri bukan model yang terlibat. Pengajaran daripada insiden tersebut, menurut syarikat itu, telah dimasukkan ke dalam langkah perlindungan baharu. 10
Konteks ini penting kerana sistem autonomi menggabungkan kebolehan model dengan keupayaan melakukan tindakan melalui pelayar, alat kod dan perisian lain. Ciri yang menjadikan model berguna—iaitu boleh bertindak merentas sistem—juga menjadikan pengasingan persekitaran, akses minimum yang diperlukan dan pemantauan lebih penting.
OpenAI menyatakan Astra mula dilancarkan kepada kumpulan organisasi yang terhad, dengan ketersediaan lebih meluas dirancang kemudian. 5
13
Untuk pembangun, harga GPT-6 Astra disenaraikan pada AS$10 bagi setiap sejuta token input dan AS$50 bagi setiap sejuta token output. Halaman model itu juga menyenaraikan tetingkap konteks sebanyak 1.05 juta token dan output maksimum 128,000 token. 3
Akses melalui ChatGPT pula diatur secara berasingan dan berperingkat. Dokumentasi bantuan OpenAI menyatakan GPT-6 Pro, yang dikuasakan Astra, sedang diperluas untuk pelan Pro AS$100, Pro AS$200, Business dan Enterprise. Pelan Plus pula menerima Astra dalam ChatGPT Work dan Codex apabila pelancaran diteruskan. Ketersediaan boleh berbeza mengikut produk ChatGPT dan tetapan ruang kerja. 6
Pelancaran GPT-6 Astra membawa dua mesej yang tidak wajar dipisahkan: OpenAI mendakwa kemajuan besar untuk kerja kompleks berasaskan ejen, dan pada masa sama mengklasifikasikan keupayaan siber model itu pada tahap risiko tertinggi yang dinyatakannya. 10
13
Penanda aras pelancaran menunjukkan apa yang menurut OpenAI boleh dilakukan Astra dalam penilaiannya. Akses berperingkat, pemantauan tambahan dan sekatan siber pula menunjukkan syarikat itu sendiri tidak menganggap keupayaan tersebut sebagai perkara rutin.
Bagi pasukan yang menilai model ini, keutamaan sepatutnya ialah penggunaan terkawal: alat dengan skop sempit, pintu kelulusan jelas bagi tindakan berimpak tinggi, persekitaran terasing dan log yang boleh disemak—bukan andaian bahawa prestasi tinggi dalam penanda aras akan terus menghasilkan autonomi yang boleh dipercayai.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAI melancarkan GPT 6 Astra secara terhad pada 3 September, menyifatkannya sebagai model paling pintar dan paling sejajar setakat ini, serta model pertamanya yang dinilai “Kritikal” bagi keupayaan keselamatan siber.
OpenAI melancarkan GPT 6 Astra secara terhad pada 3 September, menyifatkannya sebagai model paling pintar dan paling sejajar setakat ini, serta model pertamanya yang dinilai “Kritikal” bagi keupayaan keselamatan siber. OpenAI melaporkan skor 98% bagi FrontierMath Tier 4, 99.9% bagi ARC AGI 3 dan 100% bagi ExploitBench.
Akses bermula untuk kumpulan organisasi terhad. Harga API disenaraikan pada AS$10 bagi sejuta token input dan AS$50 bagi sejuta token output, manakala ketersediaan ChatGPT diperluas secara beransur ansur mengikut pela...