OpenAI 喺 9 月 3 日推出 GPT-6 Astra,定位係處理高難度端到端工作嘅模型:推理、編程、研究、建立文件同操作電腦都涵蓋在內。公司稱,模型可利用使用者提供嘅背景資料同工具,將複雜任務由最初要求一路做到交付結果。
1
8
不過,發布當日最搶鏡嘅唔係逾百萬 token 上下文視窗,亦唔係代理式操作能力,而係一個更直接嘅問題:我而家用唔用到?
旗艦模型推出,付費用戶卻要等
Astra 採用分階段推出。首批獲得存取權嘅,係 OpenAI 申請制網絡安全計劃 Daybreak 內嘅公司;ChatGPT Plus、Pro、Business 及 Enterprise 用戶、API 用戶,以及雲端平台用戶,則被告知會喺其後幾日陸續開放。
4
8
呢個次序自然造成落差:一邊公開宣傳新旗艦模型,一邊連部分預期可優先使用高階服務嘅 Pro 訂戶都仍然等緊。更何況 Astra 唔係單純研究展示;OpenAI 將佢包裝成可實際完成工作的工具,能夠處理由要求、資料、工具使用到成品交付嘅完整流程。
1
所以,技術規格再吸引,發布敘事仍然被存取問題主導。用戶首先想知道嘅,並非 context window 有幾大,而係自己嘅帳戶幾時先見到個模型。
點解唔可以當成一般模型更新?
核心原因係 Astra 嘅網絡安全級別。OpenAI 表示,Astra 係首個喺其《Preparedness Framework》中達到「Critical」網絡安全能力門檻嘅模型。公司指,在有合適工具及存取權嘅情況下,模型可以喺毋須人類逐步指導下,發現未知保安漏洞,並構思跨多個防護嚴密系統嘅利用方法。
29
30
OpenAI 喺發布前已提醒,額外安全措施有時可能會「減慢、暫停或停止合法工作」。
3 呢點唔會消除訂戶等候時嘅不滿,但解釋咗公司點解選擇受管控部署,而非所有人同日開放。
換句話講,令 Astra 特別突出嘅能力,同時亦令一個無阻滯嘅首日全面推出更難合理化。
Astra 到底主打乜嘢?
OpenAI 將 Astra 定位為編程、研究、電腦操作及複雜多步驟工作嘅升級。公司稱,佢可以按範本同指示建立文件、試算表同簡報;使用者中途加要求或者改方向,模型亦可以配合調整。
1
5
發布報道提到,Astra 嘅上下文視窗為 105 萬 token,最大輸出為 12.8 萬 token;同時亦具備上述「Critical」網絡安全級別。
18
30 Reuters 列出嘅預期應用包括報稅準備、遊戲開發、建築渲染、法律備忘錄格式整理,以及搵樓。
2
對開發者同團隊而言,真正吸引力唔在於單一數字,而係可望將長篇資料理解、軟件工作、研究同電腦互動放入同一條工作流程。但當最初只有少量機構可以試用時,外界亦難以即時驗證呢類能力喺自身環境嘅實際價值。
OpenAI 點樣回應?道歉加「用量重設」
OpenAI 當時提出嘅補償,唔係退款,亦冇承諾一個確實嘅全民開放日期。公司表示,付費 ChatGPT 用戶每一日未能使用 Astra,會獲得一次「已儲存用量重設」(banked reset)。
47
Sam Altman 亦承認推出安排出現問題,表示團隊會盡快擴大開放範圍,並指較大規模擴展時會先處理 Pro 訂戶。
47
不過,額外用量只係補償等候期間嘅使用容量,並不能取代新模型本身。對訂戶而言,想要嘅係已公布嘅 Astra,而唔係現有產品多一次配額;亦正因如此,補償未能令「無得用」呢個焦點淡出。
生產力數據有想像空間,但未足以定論
早期資料顯示 Astra 可能帶來顯著效益,但解讀時要格外審慎。
OpenAI 的發布材料重點放喺模型能否將多步驟工作做至交付成果。
1
5 Reuters 報道公司提供嘅例子:搵貓保姆資料,Astra 用咗 5 分 27 秒,人手要約 30 分鐘;求職搜尋任務則為 2 分 51 秒,對比冇 Astra 時約 5 小時。
2
呢啲係公司示範產品願景嘅個案,並非獨立、普遍適用嘅開發者或知識工作者生產力研究。現有資料未能建立一個可信、廣泛驗證嘅百分比改善指標。企業若考慮採用,仍要按自己嘅工作流程、保安規範同人工覆核需要測試。
同一星期模型密集登場,企業更易「模型疲勞」
Astra 推出時,前沿模型市場亦相當擠迫。報道列出,Anthropic 有 Claude Fable 5.1 同 Claude Mythos 5.1,Google 有 Gemini 3.8 Flash 及 Cyber 版本,Meta 則有 Muse Spark 1.3,全部都喺相近時段發布。
12
15
對企業買家而言,每一個新模型都可能觸發一輪評估:安全審查、系統整合、採購、管治同成本分析,樣樣都要時間。喺咁密集嘅更新節奏下,較大 context window 或亮眼 benchmark,通常不足以令企業即刻轉用;更關鍵係模型能否用到、可否安全放入目標環境,以及喺自己任務上係咪真係明顯更好。
發布日嘅真正教訓
GPT-6 Astra 顯示,前沿 AI 模型發布愈來愈似一場營運考驗,而唔係一張規格表。OpenAI 推出咗一個雄心甚大、同時受嚴格網絡安全措施約束嘅模型。
1
29
但首日觀感最終由一件更實際嘅事決定:獲選機構可以試,很多付費客戶卻未可以。對個人用戶同企業來講,最要緊嘅始終係三件事——而家有冇得用、可唔可以安全部署,以及能否帶來可量度嘅工作價值——而唔只係 token 數字同功能宣稱。