Ox Alpha 是 Z.ai 的 GLM 5.3 Flash 匿名預覽版,Z.ai 於 2026 年 8 月 26 日確認身分,並非仍未揭曉的新 AI 實驗室模型。 它曾短暫終結 DeepSeek 在 OpenCode 排名榜連續 56 天居首的紀錄,並吸引異常高的使用需求;不過,完整測試結果較接近 Claude Opus 4.8,不能據此證明它全面勝過 Claude Fable 5。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Ox Alpha 是一款短暫以匿名身分亮相的 GLM-5.3-Flash,屬於 Z.ai 的 GLM 系列。它在 2026 年 8 月 20 日登上 OpenRouter 與 OpenCode,供應商標示為「Stealth」,提供 1,048,576 Token 上下文視窗、文字/圖片/影片輸入、原生工具呼叫,以及預覽期間輸入與輸出免費的待遇。Z.ai 其後證實,這正是它在正式發布前以 ox-alpha 名義匿名測試的模型。110
這場發布成為一個值得注意的案例:在沒有傳統模型卡、完整官方基準測試或公開品牌宣傳的情況下,模型仍能靠分發渠道、極低使用門檻與針對 AI Agent 設計的能力,迅速成為開發者社群焦點。
匿名頁面將 Ox Alpha 定位為面向程式設計、長時間 Agent 工作流程與生產環境的推理模型。對免費預覽來說,它的規格相當進取:
stealth/ox-alphaOpenRouter 與 OpenCode 對免費開放期的描述並不完全相同。OpenRouter 曾表示其路線的開放時間較短,OpenCode 則稱從 8 月 20 日起約免費一週。因此,免費路線大致可能在 8 月 24 至 27 日之間陸續結束,而不是所有平台都有同一個明確截止時間。2412
百萬 Token 上下文並不代表模型必然更聰明,但會改變開發者能夠嘗試的工作方式。程式設計 Agent 可以在同一個工作階段保留更多程式庫內容、工具輸出、錯誤日誌與視覺資訊,減少反覆摘要或捨棄上下文的需要。加上影片輸入,Ox Alpha 也能延伸至介面測試,以及不只依賴文字的程式開發流程。343
Ox Alpha 最初吸引人的地方,與其說是神秘感,不如說是實用性。開發者可以零 Token 成本試用具備超長上下文、多模態輸入與工具能力的編程模型,而且可用額度相對寬鬆。對正在測試程式庫修復、瀏覽器互動及長時間軟體工程任務的 Agent 開發者而言,這大幅降低了試錯門檻。
模型的能見度很快上升。它曾短暫終結 DeepSeek 在 OpenCode 排名榜連續 56 天居首的紀錄,相關報道也形容其單日需求出現異常高峰。發布期間流傳的超大容量與 Token 使用量,並非全部都經過獨立審核,因此更適合視為市場熱度的訊號,而不是精確的生產規模統計。114
這個區分很重要:免費試用期間的熱門程度,往往同時反映模型能力、新鮮感、價格與供應量。它本身並不能證明模型整體上是最強系統。
早期最廣泛流傳的說法,是 Ox Alpha 在 DeepSWE 取得 80%。這個數字來自 10 項任務中成功完成 8 項,確實是令人鼓舞的初步訊號;但樣本只有 10 題,並不足以支撐穩定的排行榜排名。較大規模的測試後來約為 63%,而 Z.ai 正式發布 GLM-5.3-Flash 時公布的數字則是 DeepSWE v1.1 的 63.4%。7634
其他完整測試得到更低的結果,包括一項涵蓋 113 項任務、報告 58.4% 的評估。該測試指出,部分失分與輸出格式及實作問題有關,正好說明 AI Agent 基準測試容易受到測試框架、工具權限、時間限制與成功條件影響。4142
因此,較穩妥的結論是:Ox Alpha 展現了強勁的編程 Agent 能力,在部分評估中達到頂尖閉源模型附近的水準,但現有證據不足以證明它穩定超越 Claude Fable 5,或全面勝過所有前沿模型。
不同測試使用了不同的任務子集、Agent 框架與評估條件。早期只測 10 題,可能得到 80% 的結果,卻未必能代表完整基準測試。較大規模測試接近 63%,而約 58.4% 的完整測試則可能對格式錯誤或測試框架行為施加了額外懲罰。
之後有報道指 DeepSWE 團隊認為,模型整體能力大致接近 Claude Opus 4.8,而不是足以證明超越 Claude Fable 5。35 因此,閱讀基準分數時,必須同時查看測試範圍與執行設定,不能把不同條件下的數字當成同一張乾淨排行榜上的可直接比較分數。
知名使用者的正面評價,與 Ox Alpha 的工作流程取向一致。Patrick Collison 透過 Agent 框架使用後,形容 Ox Alpha「非常令人印象深刻」;HermesAgent 創辦人則表示,模型表現超過團隊內部多項評估標準。3335
這些反應可視為實際操作效用的回饋,尤其反映模型在程式設計與 Agent 任務上的表現;但它們不等於受控的跨基準結論,也不代表 Ox Alpha 在所有用途都優於其他模型。模型可能因為上下文長度、工具呼叫行為、速度、多模態支援或成本,在特定工作流程中特別好用,即使它在整體基準排名上的位置仍有不確定性。
在官方揭曉之前,研究者主要將 Ox Alpha 的可觀察行為,與小米 MiMo 團隊、Google DeepMind 及智譜 AI 的 GLM 系列作比較。
小米之所以被列為候選者,部分原因是 MiMo 團隊過去曾使用匿名代號「Hunter Alpha」進行測試。不過,相關報告指出兩者在能力配置上存在落差:MiMo 模型與音訊支援有關,而 Ox Alpha 可接受文字、圖片與影片,卻不支援音訊。因此,小米是合理的猜測對象,卻不是有力的身分證據。2229
一些與 Google 有關的線索及社交平台貼文,也推高了另一輪猜測;但現有資訊無法證明 DeepMind 建立或營運了該端點,相關說法仍屬間接線索。
在正式揭曉前,最有力的方向指向智譜的 GLM 系列。社群測試顯示,Ox Alpha 在不同提示詞下的 Token 計數,與 GLM-5.3 的結果相符,唯一明顯差異是每次請求固定多出約 75 個 Token,可能來自系統提示或路由包裝器。獨立影片測試則發現,它在多項編碼特徵上的 Token 消耗,與智譜的 GLM 視覺模型相符。1821
其他被報道的線索包括:
reasoning_effort 錯誤訊息與 GLM API 回應相似;單一線索可能來自路由、包裝器、共用基礎設施,甚至模仿行為;但多項指紋疊加後,GLM 假說變得越來越可信。最終仍是 Z.ai 的官方說法,將 Ox Alpha 確認為 GLM-5.3-Flash,並完成了正式命名發布。1043
這次揭曉,讓 Ox Alpha 從「追查幕後開發者」的謎題,變成一款正式產品預覽。Z.ai 文件將 GLM-5.3-Flash 描述為混合式模型,總參數達 3,200 億,每個 Token 實際啟用 180 億參數;它也具備原生視覺能力,可觀察介面、查看渲染結果與互動回饋,在程式碼、瀏覽器和圖形介面之間形成閉環。43
正式發布亦處理了匿名端點最大的問題:使用者無法確定服務能否延續。相關報道指出,GLM-5.3-Flash 以 MIT 授權發布,並提供模型權重,讓開發者在符合自身硬體與營運條件的前提下,取得更高的部署控制權。1950
不過,MIT 授權並不代表每種部署都自動安全或便宜。團隊仍需評估硬體需求、推理速度、API 條款、私隱處理、流量限制、工具呼叫可靠性,以及模型輸出的一致性。
免費預覽帶來了注意力,但長期採用仍取決於更持久的產品條件:
Ox Alpha 的核心啟示,並不是一款匿名模型曾短暫擊敗某個知名競爭者,而是:當模型具備吸引人的工作流程設計,再配合大規模、低成本的試用機會,就能在正式公開之前快速擴散。
它的基準測試故事比最初的爆紅標題更複雜,但長上下文、多模態輸入、工具使用、Agent 編程與低成本存取的組合,確實足以引起開發者關注。如今身分已確定為 GLM-5.3-Flash,真正的考驗是:當新鮮感與免費存取不再替模型加分時,這套能力組合是否仍然值得使用。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Ox Alpha 是 Z.ai 的 GLM 5.3 Flash 匿名預覽版,Z.ai 於 2026 年 8 月 26 日確認身分,並非仍未揭曉的新 AI 實驗室模型。
Ox Alpha 是 Z.ai 的 GLM 5.3 Flash 匿名預覽版,Z.ai 於 2026 年 8 月 26 日確認身分,並非仍未揭曉的新 AI 實驗室模型。 它曾短暫終結 DeepSeek 在 OpenCode 排名榜連續 56 天居首的紀錄,並吸引異常高的使用需求;不過,完整測試結果較接近 Claude Opus 4.8,不能據此證明它全面勝過 Claude Fable 5。
GLM 5.3 Flash 延續了原本的核心賣點:原生視覺能力、總參數 3,200 億且每次啟用 180 億參數的混合架構,以及 MIT 授權權重;免費匿名路線消失後,開發者仍可考慮自建部署。