Artificial Analysis 在 Intelligence Index 中給予 Grok 4.6 61 分。這是一項綜合評測,涵蓋推理、程式設計、工具使用及知識工作等多項能力;結果顯示 Grok 4.6 與 GPT-5.6 Sol Max 持平,並比 Grok 4.5 High 高 5 分。
這個成績代表 Grok 4.6 已站上前沿模型競爭位置,但並不等於它在所有基準測試中都勝出。同一比較中,仍有其他模型取得更高總分;在程式設計、推理及知識工作等不同測試,Grok 4.6 也呈現各有勝負的情況。
它更鮮明的賣點是效率。引用的比較顯示,Grok 4.6 的標準 API 價格為每百萬輸入 token 2 美元、每百萬輸出 token 6 美元;GPT-5.6 Sol standard 則為 5 美元及 30 美元。 因此,較準確的說法是:Grok 4.6 是一個具競爭力的性價比前沿模型,而不是在所有任務中都無可取代的最佳模型。
Grok 4.6 首先透過 xAI API 及 xAI 自家的開發者產品推出,包括 Grok Build 和 Cursor。xAI 也列出 OpenRouter、Vercel 及 Cloudflare 等合作夥伴作為可用管道。
之後,模型進一步擴展至更多開發平台:
這種分發方式再次凸顯它的開發者導向:Grok 4.6 不只是獨立聊天機器人,也被放進程式設計工具、雲端基礎設施及代理程式平台,讓開發者能在原有工作流程中直接測試。
約在 8 月 20 日,部分在 Grok.com 使用 Grok Lite 的使用者表示,系統沒有正常回答問題,反而輸出大量不連貫、沒有意義的文字。相關回報主要集中在直接透過網站提出查詢的情況;X 平台上的 Grok 體驗則看起來未受影響。有使用者表示重新整理後恢復正常,但也有人即使多次重新整理仍持續遇到問題。
Grok 官方帳號將問題形容為「罕見的暫時性生成故障」,並表示官方服務狀態頁沒有顯示大範圍事故;對受影響使用者的建議是開啟新的聊天視窗,或重新產生回覆。
目前這起事件被描述為暫時性的回覆生成問題,而不是 Grok 4.6 整體無法使用的證據。不過,這也提醒使用者:如果模型突然開始輸出完全不連貫的內容,應先停止引用該回覆,嘗試開啟新對話或重新生成,再檢查結果是否恢復正常。
綜合發布內容、價格及合作平台,xAI 的競爭策略大致可歸納為四點:
較審慎的結論是:Grok 4.6 被定位為一款面向生產環境代理程式及開發者工作流程、成本相對經濟的前沿模型。這是根據 xAI 的產品設計、定價及分發策略所作的推論,並不代表它已被證明能在每一項實際任務中擊敗所有競爭對手。