OpenAI於9月3日開始有限度推出GPT 6 Astra,稱佢係旗下最聰明、最能遵守指示嘅模型,亦係首個被評為網絡安全能力「Critical」級別嘅模型。 OpenAI公布Astra喺FrontierMath Tier 4得98%、ARC AGI 3得99.9%、ExploitBench得100%;公司稱只要配備合適工具及存取權,模型可找出未知漏洞並設計新利用方法。
發布者使用 GPT-5.6 Terra 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
OpenAI喺9月3日公布GPT-6 Astra,定位係處理高難度、多步驟工作嘅模型,涵蓋寫程式、研究、操作電腦同專業工作流程。公司稱佢係目前最聰明、亦最「aligned」(較能跟從用戶意圖與任務界線)嘅模型,但首輪只向有限機構開放,未即時全面推出。 2
5
13
今次發表最值得留意嘅,唔單止係OpenAI所公布嘅基準測試成績,而係公司話Astra係首個達到其《Preparedness Framework》網絡安全能力**「Critical」**門檻嘅模型。換言之,睇能力宣傳時,亦要連埋佢嘅風險分級同分階段開放安排一齊睇。 10
12
OpenAI指Astra喺電腦操作、網頁瀏覽、軟件工程、網絡安全、科學同專業工作方面表現領先。開發者文件則將佢定位為適合複雜推理、程式開發、電腦操作、研究同文件製作。 1
3
13
公司公布嘅三項突出評測結果係:
呢啲數字反映OpenAI自行公布嘅評測結果,唔係由獨立第三方重複驗證。基準測試高分,可以顯示模型喺指定題目上有進步;但單靠分數,唔足以證明佢有通用智能、喺真實世界一定判斷可靠,或者喺所有環境都可以安全自主行動。
按OpenAI講法,Astra係首個喺其Preparedness Framework下被列為網絡安全能力「Critical」級別嘅模型。公司對此嘅定義係:只要模型有合適工具同存取權,就可以喺毋須人類逐步指揮下,發現此前未知嘅保安漏洞,並喺多個防護嚴密嘅系統中發展新嘅利用方法。 10
12
呢項能力聲稱有兩個重要界線:
OpenAI表示,已針對有害網安行為加強保護措施,包括喺Astra推出期間增加監察。 5
10 公司無即時全面開放,而係採取逐步推出,亦同佢所確認嘅額外風險相符。
OpenAI亦稱Astra係旗下最aligned嘅模型,話佢更能遵守任務範圍,並以較透明方式溝通。 2
13
不過,「aligned」應該審慎理解。模型發表時所講嘅對齊,通常係指模型喺特定訓練方法同評測下嘅表現,唔代表代理式系統必定永遠正確理解用戶意圖、嚴守每一條操作界線,或者毋須人手覆核都可以安全上線。OpenAI本身嘅發表說明亦提到,Astra加入額外監察,目標係找出代理可能誤解指示嘅情況。 5
對考慮使用代理式AI嘅機構而言,實際問題唔係模型有冇「aligned」呢個標籤,而係:佢有咩權限、邊類重要操作要人手批准、有冇完整日誌,以及一旦行為異常可否迅速停止。
所提供材料提及,部分評測數字其後曾被補充或加註說明,包括基準資料受污染嘅憂慮,以及特殊存取設定與預設正式環境存取之間嘅差異。材料亦提到,有測試顯示,單靠監察模型嘅chain-of-thought(推理過程文字)未必及掌握完整上下文咁有效。
不過,現有一手來源節錄未提供所有已公布結果嘅完整、可獨立審計修訂紀錄,亦未交代全部監察方法細節。因此較穩妥嘅結論係:發布初期嘅主打基準數字與安全評估,都應視為會持續更新嘅證據;如要依賴某個分數或部署聲稱,應先查閱最新模型文件及安全資料。 2
3
10
今次發表之前,OpenAI模型曾涉及一宗較早前嘅安全測試事件;OpenAI表示,事件影響咗公司為Astra制定嘅安全做法。公司發表材料稱,Astra並非涉事模型,但當中嘅經驗已納入Astra嘅防護設計。 10
呢個背景好重要。自主系統結合咗模型能力,同埋透過瀏覽器、程式工具及其他軟件執行操作嘅能力。模型之所以實用,正正因為佢能跨系統做事;但同一個特性,亦令隔離、最小權限原則同持續監察更加不可少。
OpenAI表示,Astra初期只向有限機構逐步推出,較廣泛開放安排會喺之後進行。 5
13
開發者方面,OpenAI列出GPT-6 Astra嘅API價錢為:每100萬輸入token 10美元、每100萬輸出token 50美元。模型頁面亦列出105萬token上下文視窗,以及最多12.8萬token輸出。 3
ChatGPT存取則另有分級,亦係逐步推出。OpenAI支援文件指,由Astra驅動嘅GPT-6 Pro正向Pro 100美元、Pro 200美元、Business及Enterprise計劃推出;Plus計劃則會隨推出進度,喺ChatGPT Work及Codex取得Astra。不同ChatGPT產品同工作區設定,可用性可能不同。 6
GPT-6 Astra今次推出,傳遞咗兩個唔應該分開理解嘅訊息:OpenAI聲稱模型喺複雜、代理式工作有顯著提升;同時,公司亦將其網安能力列入最高已公布風險級別。 10
13
基準分數係OpenAI所指模型喺指定評測中做到嘅表現;分階段存取、額外監察同網安限制,則反映公司並未將呢類能力視為一般、低風險功能。對評估Astra嘅團隊嚟講,優先事項應該係受控部署:工具權限要窄、影響重大的操作要設明確審批關卡、放喺隔離環境運行,並保留可檢視嘅操作日誌——而唔係假設基準高分自然等於值得完全信任嘅自主能力。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
OpenAI於9月3日開始有限度推出GPT 6 Astra,稱佢係旗下最聰明、最能遵守指示嘅模型,亦係首個被評為網絡安全能力「Critical」級別嘅模型。
OpenAI於9月3日開始有限度推出GPT 6 Astra,稱佢係旗下最聰明、最能遵守指示嘅模型,亦係首個被評為網絡安全能力「Critical」級別嘅模型。 OpenAI公布Astra喺FrontierMath Tier 4得98%、ARC AGI 3得99.9%、ExploitBench得100%;公司稱只要配備合適工具及存取權,模型可找出未知漏洞並設計新利用方法。
首批存取權只限部分機構。API定價為每100萬輸入token 10美元、每100萬輸出token 50美元;ChatGPT則按不同計劃及產品逐步推出。