Grok Build 的進展相當迅速:
grok-build-0.1 版本推出早期測試版,初期僅限 SuperGrok Heavy 訂閱用戶(每月 299 美元)使用 。grok-build-0.1 取代了舊有的 grok-code-fast-1 API 端點 。1.0 版本主要是一個 穩定性和成熟度的里程碑,而非模型升級。底層的 grok-build-0.1 模型與測試版相同 。V1.0 版本的關鍵改進包括:
從測試版延續至 V1.0 的核心功能:
grok-build-0.1(衍生自 Grok 4.x 架構)grok-code-fast-1;目前模型的基準測試尚未單獨發布)Grok Build V1.0 進入了一個競爭激烈的市場,雖然在原始基準測試分數上落後,但提供了獨特的架構優勢:
| 功能 | Grok Build V1.0 | Claude Code | Codex CLI |
|---|---|---|---|
| 開發商 | xAI | Anthropic | OpenAI |
| 預設模型 | grok-build-0.1 (Grok 4.x) | Claude Opus 4.7 / Sonnet 4.6 | GPT-5.5 |
| 上下文視窗 | 256K | 200K (Opus 4.7 為 1M) | 200K–1M |
| 多代理架構 | 最多 8 個平行子代理,於獨立 worktree 中運作 | 任務工具子代理 | 子任務工具 |
| 規劃模式 | ✅ | ✅ (Shift+Tab) | ✅ |
| SWE-Bench Verified | 70.8% | 87.6% | 88.7% |
| API 輸入價格 | 約每百萬代幣 1 美元 | 較高(前沿模型) | 各有不同 |
| 入門價格 | 綁定 SuperGrok / X Premium+ | 包含於 Claude Pro ($20/月) | ChatGPT 訂閱 |
| 獨特差異化優勢 | 平行子代理 + Arena Mode;最便宜編碼 API | 最審慎的規劃再執行;深度的多檔案重構 | 內建審查代理;沙箱優先;全能模態骨幹 |
資料來源:
結論: Grok Build 在原始基準測試分數上落後(70.8% 相較於競爭對手的約 88%),但其 價格優勢(每百萬代幣約 1 美元/2 美元,遠低於其他前沿模型)和 平行子代理架構(最多 8 個並行代理)是其競爭籌碼 。評測指出,它最適合已身處 xAI 生態系(SuperGrok/X Premium+)的開發者;而 Claude Code 更適合複雜的生產環境重構任務,Codex CLI 則在沙箱優先的工作流程中表現出色 。
Grok 4.6 預計於同一天——2026 年 8 月 7 日——發布,形成一套協同的組合拳 :
雙重發布策略的運作方式如下:
注意: 所有 Grok 4.6/4.7 的細節皆來自 Elon Musk 在 X 上的一則回覆;尚未發布官方模型卡或第三方基準測試 。