Ox Alpha 最初像是一個「沒有人認領」的高效能 AI 模型。它約在 2026 年 8 月 20 日出現在 OpenRouter——一個整合多家 AI 模型 API 的平台——以免費的「stealth model」身分開放使用,主打程式設計、長時間執行的 AI 代理任務,以及實際生產工作流程。短短幾天內,它登上平台使用榜首,使用量更超過 DeepSeek 兩倍。1710
謎底在 8 月 26 日揭開:北京 AI 公司 Z.AI(亦稱智譜、Zhipu)證實,Ox Alpha 是其 GLM 系列的新模型。公司同時表示將公開模型權重,令這場病毒式的市場預覽,進一步變成一場開放權重中國模型能否持續吸引全球開發者的測試。318
Ox Alpha 是什麼?
Ox Alpha 被定位為面向軟體開發與 AI 代理工作的推理模型。OpenRouter 將它描述為適合長週期軟體工程、複雜推理,以及結合文字與視覺資訊的工作流程。15
公開列出的功能包括:
- 約 100 萬 token 的上下文視窗
- 接收文字、圖片與影片輸入
- 工具呼叫
- 程式設計與軟體工程任務
- 持續運作、需要長時間保留任務脈絡的 AI 代理工作流程
- 預覽期間免費使用1517
對開發者而言,這些規格特別適合用來測試大型程式碼庫,或讓 AI 代理處理包含大量歷史資訊的複雜任務。不過,現有報導尚未建立完整的技術檔案,包括確定的參數規模,以及在廣泛基準測試中經獨立驗證的整體表現。
為什麼它成了 OpenRouter 最大的模型發布?
Ox Alpha 的爆發,主要由三股力量互相推動:免費、表現,以及神秘感。
首先是價格。模型在預覽期間完全免費。開源 AI 程式設計代理 OpenCode 表示,試用期約為一週,使用量接近不限;但 OpenRouter 另行通知用戶,其路由可能在更早時間結束。換言之,不同公告對免費服務的確切截止日期並不一致。1715
其次是實戰回饋。開發者很快把 Ox Alpha 接入程式設計工具,並放進真實軟體儲存庫測試。這讓它的受眾不只限於追蹤排行榜的 AI 愛好者,而是直接進入日常開發工作流程。5
最後是匿名發布帶來的「盲測」效果。在品牌尚未曝光前,開發者先根據模型表現作出判斷;與此同時,大家對其真正來源的猜測又進一步推高社群討論度。到 8 月 26 日,Ox Alpha 已登上 OpenRouter 排行榜首位,報導指其使用量超過 DeepSeek 兩倍。3810
但這個數字需要準確解讀:它衡量的是單一模型市場在大幅補貼的免費預覽期間所產生的活動,不等於全球整體使用量,也不能單獨證明模型品質全面領先。免費存取本身就會大幅降低試用門檻,而匿名身分更鼓勵人們「先試再說」。
Z.AI 證實與 GLM 系列的關聯
Z.AI 的說法,將 Ox Alpha 與公司的 GLM 模型家族連結起來。Z.AI 早前已把 GLM-5.3 定位為專注程式設計與 AI 代理能力的開放權重模型,並聲稱它在部分測試中已接近 Anthropic 的 Fable 5。
Z.AI 公布的數據包括 Terminal-Bench 3.0 得分 28.3%,以及 DeepSWE 1.1 得分 66.9%。這些數字由 Z.AI 提供,並被公司描述為開放源碼模型中的領先成績。
不過,廠商公布的數據不等同於獨立證明 GLM-5.3 或 Ox Alpha 已經擊敗所有頂尖閉源模型。現有資料中的一項比較顯示,GLM-5.3 在 Z.AI 自家的程式設計基準測試中仍低於 Fable 5;在其他測試裡,兩者則各有勝負。
較穩妥的結論是:Z.AI 已打造出一個具認真競爭力的程式設計與 AI 代理模型,而不是 Ox Alpha 事件已證明中國模型全面領先。
「牛來」是什麼?哪些說法仍未證實?
中國網路社群開始把 Ox Alpha 稱為「牛來」,原因是英文名稱中的「Ox」讓人聯想到近期上映、在中國網路上引發大量討論的動畫電影《牛來》。由於模型在沒有正式公開身分的情況下出現,這個綽號很快傳開。2
目前有報導支持「牛來」是社群稱呼,也支持供應商在預覽期間刻意隱藏身分。但資料並未證實 Z.AI 曾公開說明,為何選用這個電影相關稱呼,或為何要隱瞞模型所有者。因此,「牛來」應視為網路暱稱,不宜直接當成產品的正式名稱。17
開發者為何關注匿名測試?
這次發布的討論範圍很快超出專業基準測試圈。Stripe 執行長 Patrick Collison 形容 Ox Alpha「非常令人印象深刻」;在 Z.AI 公布身分前,開發者和觀察者則曾猜測模型可能來自 Z.AI、Microsoft 或其他研究團隊。91116
這反映出匿名模型測試的優點與限制。拿掉熟悉品牌,或許能減少部分先入為主的期待效應;但同時也拿掉了開發者在負責任部署時通常需要掌握的資訊,例如:服務由誰營運、提示內容在哪裡處理、資料如何保留,以及預覽結束後能否取得支援。
OpenRouter 的模型頁面據報曾提醒用戶,匿名供應商會保留提示內容與模型回覆。對正在測試專有程式碼的開發團隊來說,這代表資料治理風險與效能機會同時存在。1
公開權重、免費預覽與未明朗的價格
Z.AI 表示,會在匿名預覽後公開 Ox Alpha 的模型權重。後續報導則把公開版本識別為 GLM-5.3-Flash,並指其權重已透過 Hugging Face 提供,讓開發者可以下載、修改及進一步建構應用。3
這裡要分清楚兩件事:託管式預覽代表開發者透過 API 使用模型;公開權重則可能讓組織在符合授權條款、硬體條件與安全控制的前提下,自行部署、調整或評估模型。
至於價格,預覽期通常被描述為約一週免費,部分公告則稱使用量接近不限。但當時的報導並未提供可靠的長期 API 定價,因此不能把暫時性的零成本試用,視為模型未來商業模式或營運成本的證明。115
這對中國 AI 競爭意味著什麼?
Ox Alpha 並非孤立事件,而是更廣泛趨勢的一部分。中國 AI 實驗室正愈來愈強調程式設計、自主代理、快速發布、低價導入,以及公開模型權重。阿里巴巴的 Qwen3.8-Max 也曾被報導在部分基準測試中追平或超越 Anthropic 的 Fable 5;不過,這類比較同樣需要檢視測試設計,並等待獨立重現。
對美國 AI 公司來說,最直接的壓力可能出現在開發者 API 與開放權重生態。只要一個具備實用能力的模型在預覽期免費,或公開後能以較低成本運行,開發者就更容易嘗試新工具;同時,這也會迫使閉源平台面對更激烈的價格與功能競爭。
然而,使用量暴增不代表策略已經獲利。報導指 Zhipu 2025 年收入增加 132%,但公司在 1 月上市後也公布了相當可觀的經調整虧損。這凸顯真正的商業問題:免費或補貼式存取帶來的病毒式採用,能否轉化為持久收入與可持續利潤。
開發者應如何看待 Ox Alpha?
Ox Alpha 的重要性,不只是匿名模型曾短暫在 OpenRouter 使用榜上超越 DeepSeek,而是它展示了一套高效率的發布策略:先隱藏品牌、移除價格障礙,讓開發者在真實工作流程中試用,再把模型與開放權重家族連接起來。
這種做法能在短時間內製造全球關注,也能為模型公司帶來實際回饋與採用數據。但對開發者而言,正式把它用於敏感程式碼或生產環境前,仍必須自行確認模型來源、資料處理方式、授權條款、基準測試方法,以及預覽結束後的價格與服務安排。
因此,Ox Alpha 最適合被理解為 AI 競爭正在升溫的證據,而不是某一個國家的模型已經全面超越其他對手的確證。