Ox Alpha 是 Z.ai(智譜 AI)GLM 5.3 Flash 的匿名預覽名稱,於 2026 年 8 月 20 日登上 OpenRouter 與 OpenCode,8 月 26 日正式揭曉身分。[3][4] 模型提供 1,048,576 Token 上下文視窗,支援文字、圖片與影片輸入、文字輸出及工具呼叫,主打程式開發與長時間運作的 AI Agent 任務。[11][13][21] OpenCode 表示 Ox Alpha 在 6 天內處理約 42 兆 Tokens,終結 DeepSeek Flash 連續 56 天的榜首紀錄;OpenRouter 的相關統計則約為 23.2 兆 Tokens。[7][11][16]
研究答案

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model Ox Alpha, when and where was it launched, how did its one-week free availability affect OpenCode and OpenRout. Article summary: Ox Alpha was the anonymous, free “stealth” preview name for Z.ai (Zhipu AI)’s GLM-5.3-Flash—a coding- and agent-oriented reasoning model. It appeared simultaneously on OpenRouter as `stealth/ox-alpha` and in OpenCode on . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Ox Alpha 的神秘面紗已經揭開:它不是一個始終不知來歷的匿名模型,而是中國 AI 公司 Z.ai(智譜 AI)旗下 GLM-5.3-Flash 的匿名預覽版本。模型在 2026 年 8 月 20 日悄悄出現在 OpenRouter 與 OpenCode,提供約一週的免費使用;8 月 26 日,Z.ai 證實 Ox Alpha 正是 GLM 系列的新模型。3
4
這次事件的重點不只在模型本身有多強,也在於「免費存取+超長上下文+直接嵌入開發工具」如何迅速放大使用量。短短 6 天,Ox Alpha 便在 OpenCode 擠下霸榜 56 天的 DeepSeek Flash,並登上 OpenRouter 用量排行榜首位。不過,流量排行榜反映的是產品吸引力與使用門檻,不等於已經完成嚴謹的性能排名。
Ox Alpha 是 GLM-5.3-Flash 的匿名代號。模型最初以 stealth/ox-alpha 的名稱列在 OpenRouter,頁面只說明它由選擇匿名的第三方供應商開發與營運,適合程式設計、持續運作的 Agent 任務及生產環境工作。OpenRouter 也特別聲明,自己只是負責路由請求,並非模型的開發者、擁有者或供應商。5
29
同一款模型也整合進 OpenCode——一個開源的終端機程式設計 Agent。預覽期間,OpenRouter 的輸入與輸出價格均為 0 美元;OpenCode 則形容使用額度接近不限量,免費期約為一週。5
18
21
Ox Alpha 於 2026 年 8 月 20 日在 OpenRouter 與 OpenCode 同時或近乎同時出現。當時公開頁面沒有列出公司名稱、完整模型卡或正式定價,而是先突出模型的上下文長度與多模態能力。5
13
29
公開規格包括:
對開發者而言,100 萬 Token 上下文意味著模型更有機會一次掌握大型程式碼庫、長篇錯誤紀錄或多輪 Agent 任務狀態;多模態輸入則可用於分析介面截圖、影片或其他視覺脈絡。不過,這些是服務頁面宣稱的規格,不能單憑規格表推論模型在實際生產環境中的穩定度。
免費是 Ox Alpha 爆發式成長最直接的原因。開發者可以在沒有 Token 成本壓力的情況下,測試長時間程式任務;OpenCode 更把它放進既有的程式設計 Agent 工作流程,降低了試用門檻。
OpenCode 表示,Ox Alpha 在 6 天內處理了約 42 兆 Tokens,成為 DeepSeek Flash 連續 56 天位居榜首後,平台上使用量最高的模型。7
16
這不只是一次短暫的排行榜波動。Ox Alpha 確實取代了原本長期領先的 DeepSeek,顯示免費額度、超長上下文與程式 Agent 整合,足以在短時間內吸引大量真實工作負載。OpenCode 後來也將這款模型改以 GLM-5.3-Flash 稱呼,確認匿名預覽與 Z.ai 正式發布的是同一個系統。16
OpenRouter 的滾動用量排行同樣曾將 Ox Alpha 列為第一。相關報告估算,在相應的 7 天統計窗口內,Ox Alpha 處理約 23.2 兆 Tokens,同期 DeepSeek V4 Flash 約為 11.6 兆 Tokens。11
42 兆與 23.2 兆不應直接相加,也不代表其中一個數字必然錯誤:兩者來自不同平台及統計窗口。較穩妥的結論是,免費預覽在兩個服務上都帶來異常龐大的流量,並在 OpenCode 與 OpenRouter 同時造成明顯的排行榜震盪。11
14
15
Ox Alpha 早期最受關注的說法,是在 DeepSWE 測試中取得約 80% 的成績。不過,這個數字來自小規模子集,並在完整、獨立評估完成前便迅速流傳,因此不能視為完整基準結果。3
31
後來一項涵蓋 113 題 DeepSWE 任務的端到端測試,給出 Ox Alpha 58.4% 的成績;同一比較中,Claude Opus 4.8 報稱為 59%。47 按這組證據,較謹慎的描述是:Ox Alpha 在該測試中約達到 Opus 4.8 等級,而不是已經明確超越 Claude Fable 5。
Fable 5 的比較尤其需要留意測試方法。公開資料列出的 Fable 5 成績包括 SWE-bench Pro 80.3% 與 SWE-bench Verified 95.0%,但這兩套測試與 DeepSWE 並不相同,可能採用不同的測試框架、任務分布及 Agent 設定。36
38
因此,目前最合理的結論是:Ox Alpha 展現了可信的前沿級程式能力,足以支撐大量 Agent 使用;但不能把早期小樣本成績或平台用量暴增,直接轉化為「全面勝過 Fable 5」的結論。
Ox Alpha 將三個平時不容易同時出現的條件結合在一起:
這個組合解釋了使用量為何會在短時間內急升。排行榜變化所證明的,是開發者對這種產品體驗有強烈需求;它不只是因為「神秘模型」這個名字引發好奇。開發者可以立即把模型放進實際工作流程,並以一般付費試用難以承受的規模使用它。
但匿名上線也帶來信任問題。相關報導質疑,模型頁面上的資料保留說明,是否與 OpenRouter 更廣泛的服務條款一致;另有報導指出,不同接入路徑可能存在隱私差異,包括 OpenCode Zen 所列的零留存,以及 OpenRouter 路徑相關的提示詞與回覆留存說明。12
17
22
對涉及專有程式碼的企業或個人來說,這不是枝微末節。免費模型不代表它天然適合處理機密程式碼;在把原始碼交給任何匿名服務前,都應先確認資料留存、訓練用途與服務商責任範圍。
在 8 月 26 日正式揭曉前,社群主要討論過幾個可能的開發者。
小米 MiMo 是其中一個業界猜測,理由主要是小米被視為有能力打造具備程式能力、又能承受大規模流量的中國 AI 團隊。不過,現有資料沒有提供已確認的 MiMo 命名關聯、託管連線、所有權紀錄或明確技術特徵。因此,這個說法只能算是合理推測,不能視為已被證實的身分線索。
「Alpha」這個名稱讓部分人聯想到 Google DeepMind,而模型展現的 Agent 式程式能力也加深了猜測。然而,兩者都不是具辨識力的證據。「Alpha」本身是通用命名,公開頁面也沒有 Google 歸屬、模型來源、基礎設施證據或模型卡,能把 Ox Alpha 與 DeepMind 連結起來。
Z.ai 是揭曉前最有力的猜測,最後也證明是正確答案。8 月 26 日,Z.ai 向 Bloomberg 表示,Ox Alpha 是 GLM 系列的新一代模型;公司其後將它正式命名為 GLM-5.3-Flash,並表示會發布模型權重。3
4
8
這裡需要區分「技術指紋分析」與「正式歸屬確認」。模型的回答風格、Tokenizer 印象、拒答行為、上下文長度或代號,都可以協助提出假設,但沒有任何單一線索能可靠證明一個封閉式 API 端點由誰營運。真正具有決定性的證據,是供應商後來親自確認身分,而不是社群逆向推測。
模型上線時沒有公開公司名稱、詳細模型卡、技術論文或一般商業品牌。OpenRouter 的頁面只表示,第三方供應商在預覽期間選擇保持匿名。5
13
29
匿名也讓使用者失去平時評估模型所依賴的訊號,例如已知的隱私政策、公開技術來源、正式支援管道,以及預覽結束後的定價。換言之,從 8 月 20 日到 Z.ai 在 8 月 26 日公布消息前,稱其「創作者未確認」是準確的;但在 Z.ai 證實後,這種說法便已過時。3
4
免費預覽已證明開發者想使用這款模型,但沒有證明他們在價格、限制、可靠性與信任都被納入考量後,仍願意持續使用。接下來至少有五個因素值得觀察。
初期報導沒有披露預覽後的正式價格。長期採用率將取決於付費方案是否仍具競爭力,以及速率限制能否支撐免費期內吸引到的工作負載。3
5
模型在病毒式發布期間表現亮眼,並不代表它能長期提供可預期的延遲、正常運作時間、工具呼叫、錯誤復原與輸出品質。當 Agent 開始修改生產環境程式碼時,這些因素往往比單一排行榜名次更重要。
下一階段最有價值的證據,會是涵蓋完整程式基準與真實程式碼庫、並清楚交代測試框架與 Agent 設定的可重現測試。這才能分辨模型的實際能力,與免費、高流量試用所帶來的暫時性優勢。
在匿名預覽已引發資料流向疑問後,清楚的留存規則、模型來源、安全措施與企業控制功能會變得格外重要。4
12
17
Z.ai 已表示會發布模型權重,這可能讓 GLM-5.3-Flash 不再局限於單一託管服務,並促進本地或自架部署。它能否持續獲得 OpenCode、OpenRouter、IDE Agent 與工具呼叫框架支援,也會決定這次爆發是短期流量,還是能發展成長期生態系。3
8
Ox Alpha 是 Z.ai 的 GLM-5.3-Flash:它在 2026 年 8 月 20 日以匿名代號接受公開測試,並於 8 月 26 日由 Z.ai 揭曉身分。免費預覽讓它在 6 天內於 OpenCode 處理約 42 兆 Tokens,終結 DeepSeek Flash 的 56 天榜首紀錄,也推動它登上 OpenRouter 用量排行第一。7
11
16
它的規格與實際採用情況都相當引人注目,但基準測試仍應保持克制。現有完整 DeepSWE 測試將它放在接近 Claude Opus 4.8 的位置;至於與 Claude Fable 5 的比較,因測試套件、框架與 Agent 設定不同,尚不能直接下定論。36
38
47
免費週證明了需求,卻沒有證明商業模式。GLM-5.3-Flash 能否把短期爆紅轉化為付費使用、可信部署、可重現的程式表現與持續成長的開放模型生態,才是 Ox Alpha 故事的下一章。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Ox Alpha 是 Z.ai(智譜 AI)GLM 5.3 Flash 的匿名預覽名稱,於 2026 年 8 月 20 日登上 OpenRouter 與 OpenCode,8 月 26 日正式揭曉身分。[3][4]
Ox Alpha 是 Z.ai(智譜 AI)GLM 5.3 Flash 的匿名預覽名稱,於 2026 年 8 月 20 日登上 OpenRouter 與 OpenCode,8 月 26 日正式揭曉身分。[3][4] 模型提供 1,048,576 Token 上下文視窗,支援文字、圖片與影片輸入、文字輸出及工具呼叫,主打程式開發與長時間運作的 AI Agent 任務。[11][13][21]
OpenCode 表示 Ox Alpha 在 6 天內處理約 42 兆 Tokens,終結 DeepSeek Flash 連續 56 天的榜首紀錄;OpenRouter 的相關統計則約為 23.2 兆 Tokens。[7][11][16]