Grok 4.6 於 2026 年 8 月 21 日以 Preview 形式加入 Google Cloud Vertex AI Model Garden,Google Cloud 客戶可以透過現有雲端環境評估 xAI 模型,但仍要自行核對資料所在地、合規及治理要求。 模型提供 500,000 token 上下文視窗、文字及圖像輸入、函數呼叫、結構化輸出,以及由低至 extra high 嘅可調推理力度。
研究答案

Create a landscape editorial hero image for this Studio Global article: What did xAI’s August 21, 2026 launch of Grok 4.6 on Google Cloud’s Vertex AI Model Garden entail for enterprise developers—including how di. Article summary: xAI’s August 21 launch put Grok 4.6 into Google Cloud’s Vertex AI Model Garden as a Preview partner model, giving enterprises a way to invoke xAI’s model through their existing Google Cloud environment rather than creati. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
xAI 於 2026 年 8 月 21 日公布,Grok 4.6 已經可以喺 Google Cloud 嘅 Vertex AI Model Garden 以 Preview 形式使用。對企業開發者嚟講,今次消息最實際嘅意義唔係又多一個模型名,而係多咗一條分發渠道:已經採用 Google Cloud 嘅團隊,可以喺現有 AI 平台入面發現、測試同部署 Grok 4.6,而唔使完全當佢係另一個獨立模型供應商整合。Google 將 Model Garden 定義為用嚟發現、測試、自訂及部署 Vertex AI 同部分開源模型嘅平台;Google 文件亦列明 Grok 4.6 嘅模型 ID 為 grok-4.6,目前階段係 Preview。
對已經將採購、權限、帳單及 AI 實驗流程放喺 Google Cloud 嘅公司,呢種接入方式可以減少營運摩擦。不過,經由 Google Cloud 使用模型,並唔會自動代表企業已經符合所有資料駐留、監管、安全或內部治理要求。正式部署之前,仍然要按實際服務設定同公司政策逐項審查。
xAI 於 8 月 12 日推出 Grok 4.6,定位係 Grok 4.5 嘅後繼版本,重點放喺長時間運作嘅代理、代理式編程,以及互動同視覺工作。
文件列出嘅主要能力包括:
呢啲功能令 Grok 4.6 適合處理需要保留大量專案背景、分析圖像再配合文字推理,或者要連續執行多個步驟嘅工作。當然,500,000 token 只係容量上限,唔代表每個應用都應該一次過塞入咁多內容。團隊要衡量額外上下文帶來嘅質素提升,是否值得付出更高成本同延遲;prompt 越長,唔一定代表設計越好。
xAI 公布嘅 Grok 4.6 價格如下,以每 100 萬 token 計算:
| 請求大小 | 輸入 | 已快取輸入 | 輸出 |
|---|---|---|---|
| 少於 200,000 個輸入 token | $2 | $0.50 | $6 |
| 200,000 個 token 或以上 | $4 | $1 | $12 |
最值得企業留意嘅地方係:當一次請求達到 200,000 token 嘅長上下文級別,收費會轉用較高一級。對經常將大型程式碼庫、文件或對話紀錄一併傳入嘅代理系統,成本預算唔可以只睇 $2 輸入同 $6 輸出呢兩個 headline 價格。
快取可以降低輸入部分嘅費用,但唔會令上下文無限增長變得冇成本。較穩陣嘅生產設計,應該實際量度 prompt 大小、快取重用率、輸出長度,以及增加上下文後對結果質素嘅幫助,再決定係咪要擴大上下文預算。
xAI 報稱,Grok 4.6 以「extra high thinking」設定喺 CursorBench 3.2 取得 70.8%,而 Fable 5 Max 報告分數係 70.5%;xAI 同時聲稱,每項完成任務嘅成本大約只有對方六分之一。
呢個結果值得繼續測試,但差距只有 0.3 個百分點,而且屬於供應商公布嘅基準比較。企業唔應該將佢直接視為 Grok 4.6 已經可以喺自己嘅程式碼庫、工具鏈、延遲目標或可靠性要求上全面勝出。
其他公開比較亦顯示,分數會因基準測試同設定不同而改變,其中一個比較表列出 Grok 4.6 嘅 CursorBench 分數為 69.9%。 Prompt、測試工具、模型設定同評估日期都可能影響結果,所以買家最好用匿名化、接近真實生產環境嘅任務重做比較。
Grok 4.6 除咗經 xAI API 提供,亦快速分發到多個開發者同雲端渠道,包括 Cursor、GitHub Copilot、Amazon Bedrock、OpenRouter、Vercel 同 Cloudflare。Amazon 於 8 月 19 日宣布 Bedrock 已經提供 Grok 4.6,時間上係首次發布約一星期之後。
Vertex AI 提供嘅價值,唔只係另一個 API endpoint。對 Google Cloud 客戶嚟講,佢哋可以喺熟悉嘅雲端控制環境同採購流程入面評估模型,亦有機會沿用現有嘅 AI 實驗、權限管理同支出管理方式。呢點可以降低團隊試用新模型嘅轉換成本。
但託管平台並唔會取代模型選擇工作。由試驗走向正式服務之前,團隊仍然要核對地區可用性、配額、資料處理方式、服務承諾、工具行為、可觀測性同失敗模式。再加上 Google 平台目前列明 Grok 4.6 為 Preview,初期部署更適合當作受控評估,而唔係假設服務一定會維持現狀。
一個實際嘅評估計劃,可以集中喺以下四方面:
xAI 將 Grok 4.6 帶到 Vertex AI,真正重點未必係一個基準測試數字,而係令模型出現喺開發者已經使用緊嘅地方。Grok 4.6 以大型上下文視窗同代理導向功能,加上具吸引力嘅 headline 價格鼓勵試用;而 API、IDE、託管平台同雲端 marketplace 之間嘅快速分發,就進一步降低採用門檻。
對企業買家嚟講,結論係有條件嘅:Grok 4.6 而家更容易喺 Google Cloud 入面評估,但最終價值仍然取決於實際工作負載嘅結果、長上下文請求嘅成本,以及 Preview 服務特性是否符合公司治理要求。70.8% 對 70.5% 嘅差距值得研究,但未足以證明係一項可以長期維持嘅優勢。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
Grok 4.6 於 2026 年 8 月 21 日以 Preview 形式加入 Google Cloud Vertex AI Model Garden,Google Cloud 客戶可以透過現有雲端環境評估 xAI 模型,但仍要自行核對資料所在地、合規及治理要求。
Grok 4.6 於 2026 年 8 月 21 日以 Preview 形式加入 Google Cloud Vertex AI Model Garden,Google Cloud 客戶可以透過現有雲端環境評估 xAI 模型,但仍要自行核對資料所在地、合規及治理要求。 模型提供 500,000 token 上下文視窗、文字及圖像輸入、函數呼叫、結構化輸出,以及由低至 extra high 嘅可調推理力度。
xAI 報稱 Grok 4.6 以最高推理設定喺 CursorBench 3.2 取得 70.8%,略高於 Fable 5 Max 嘅 70.5%,並聲稱每項完成任務成本約只有六分之一;不過,呢個只係供應商公布、差距好窄嘅基準測試結果,未代表所有企業工作負載都會有優勢。