Grok 4.5喺2026年6月28日開始喺SpaceX同Tesla做私人測試,用嘅係1.5萬億參數嘅V9基礎模型,V9喺2026年5月26日完成預訓練 。Grok 4.5嘅API喺7月8日推出,收費係每100萬輸入token $2美元、每100萬輸出token $6美元 。今次Grok 4.6參數比起上一代 多咗33%,由1.5T跳到2T 。
| 規格 | Grok 4.5 | Grok 4.6 |
|---|---|---|
| 參數 | 1.5萬億 | 2萬億 |
| 基礎模型 | V9(2026年5月26日完成訓練) | 下一代(架構細節未公佈) |
| 狀態 | SpaceX同Tesla私人測試(6月28日起);API 7月8日推出 | 訓練今週完成;預計8月推出 |
| API價格 | 輸入$2/百萬token,輸出$6/百萬token | 未公佈 |
| 表現 | xAI自稱接近/超越Claude Opus;無獨立第三方評測 | 聲稱超越Grok 4.5;目標係贏Kimi K3 |
有一個好重要嘅位要注意:Grok 4.5到目前為止冇任何獨立第三方嘅評測分數 — 所有表現聲稱都係xAI自己講嘅 。有xAI工程師仲話,Grok 4.5用咗「Cursor數據」(編碼相關數據)做補充訓練,但呢啲數據唔係一開始就喺初始訓練入面,效果「冇咁理想」。
馬斯克喺呢個時間點公佈Grok 4.6,同 Moonshot AI喺2026年7月16日推出Kimi K3 有直接關係 。Kimi K3係一個 2.8萬億參數、開放權重(open-weight)嘅混合專家模型(MoE),有 100萬token嘅上下文窗口 同原生視覺能力,係有史以來最大嘅開放權重AI模型,亦都係第一個達到「3T級別」嘅模型 。佢每次推理只啟動896個專家入面嘅16個,用呢個設計嚟降低運算成本 。
馬斯克嘅帖文直接話Grok 4.6就係回應呢個挑戰,目標係 超越Kimi K3 嘅表現,同時保持Grok喺速度同效率上嘅優勢 。Grok 4.6嘅2T參數細過Kimi K3嘅2.8T,所以xAI係賭緊 架構效率同推理優化,而唔係單純鬥參數數量 。
呢個就係最關鍵嘅地方:Grok 4.5根本冇獨立評測分數。佢所有競爭聲稱都係xAI自己講。相反,Kimi K3經過獨立評測,喺綜合排行榜上排 全球第3,僅次於Anthropic嘅Claude Fable 5同OpenAI嘅GPT-5.6 Sol 。佢喺編碼同網頁開發評測上甚至贏過Claude Fable 5 。有描述話K3嘅表現同美國最強嘅專有系統「差唔多」。
至於價格方面,Kimi K3嘅API傳聞大概係 同級前沿模型(例如Claude Fable 5同GPT-5.6 Sol)嘅一半 。確切嘅每token收費就冇喺高權威來源搵到。
重點係:目前完全冇任何Grok模型同Kimi K3之間嘅直接獨立評測比較。 xAI所有關於表現嘅講法,都只係馬斯克喺社交媒體上未經證實嘅聲稱。
馬斯克7月18日嘅公佈只係一個更大計劃嘅一部分。以下係xAI已經公開承諾嘅嘢:
除咗模型競賽,xAI喺 2026年7月15-16日開源咗Grok Build,用Apache 2.0授權,將佢嘅Rust編寫命令列編碼Agent放咗上GitHub(xai-org/grok-build)。Grok Build有8個並行子Agent、計劃先行嘅工作流程,同Arena Mode。呢個開源行動係為咗回應之前嘅私隱風波:安全研究員發現,之前嘅版本會將用戶嘅成個工作目錄上載到xAI嘅伺服器 。透過開放源碼,xAI想重建信任,同時加速社群採用。
另外,馬斯克喺7月8日確認,xAI會 每日根據用戶反饋改進Grok Build 。呢個動作令xAI直接挑戰Cursor同GitHub Copilot呢啲編碼Agent對手。
馬斯克7月18日公佈Grok 4.6,明顯係 針對Moonshot嘅Kimi K3嘅反擊,時間上只係遲咗兩日。xAI每月出新模型嘅速度係所有前沿AI實驗室之中最快嘅,而Grok 5路線圖仲預示住更大嘅模型喺後面。但係,所有xAI模型都缺乏獨立評測,令到所有競爭聲稱喺第三方測試出爐之前都係未經證實。喺呢場唔只鬥規模、仲要鬥透明度嘅競賽入面,呢個差距好重要。