Z.aiは2026年8月26日、OpenRouterとOpenCodeで匿名提供していた「Ox Alpha」がGLM 5.3 Flashだったと明らかにした。総パラメータ数は3,200億、1トークンあたりのアクティブパラメータは180億で、重みはMITライセンスで公開された。 GLM 5.3 Flashはテキスト・画像・動画をネイティブに入力でき、約100万トークンのコンテキストに対応する。Z.aiの公称価格は入力100万トークンあたり0.15ドル、出力100万トークンあたり0.50ドル。
研究の答え

Create a landscape editorial hero image for this Studio Global article: What did Z.ai, the Chinese AI company formerly known as Zhipu AI, reveal about the anonymous “Ox Alpha” model that appeared free and without. Article summary: Z.ai disclosed on August 26 that the previously anonymous, free “Ox Alpha” preview was **GLM-5.3-Flash**—the first natively multimodal GLM-5 model. It is an open-weight, low-cost coding and agent model whose stealth rele. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
2026年8月26日、Z.aiは謎の匿名モデル「Ox Alpha」の正体を明らかにした。OpenRouterやOpenCodeで無料提供されていたモデルは、GLM-5.3-Flashだった。Z.aiによれば、同モデルはGLM-5シリーズで初めてネイティブなマルチモーダル入力に対応したモデルで、オープンな重み、約100万トークンのコンテキスト、コーディングや長時間動作するAIエージェント向けの設計を特徴とする。1540
ただし、今回のニュースの核心はモデル名だけではない。Ox Alphaは、匿名・無料のプレビューとして公開されながら、開発者による大規模な実運用に使われた。その後、Z.aiはモデル名を明らかにし、ダウンロード可能な製品として正式公開した。つまりこの展開は、実際のワークロードで推論基盤を試験しながら、正式リリースへの期待も高める「ステルス公開」だったと考えられる。
GLM-5.3-Flashは、総パラメータ数3,200億、1トークンあたりのアクティブパラメータ数180億のMixture-of-Experts(MoE)モデルだ。テキスト、画像、動画をネイティブに受け付け、出力はテキストに対応する。コンテキスト容量はおよそ100万トークンとされているが、表示上の上限はサービスによって異なる。Z.aiの資料は100万トークン設計を示し、OpenRouterでは1,310,720トークンと記載されている。12340
重みはMITライセンスで公開された。一般的なAPI専用のクローズドモデルと比べ、利用者が自社環境への導入や運用方法を検討しやすい形だ。匿名プレビューの終了後、OpenRouterでも正式名称のモデルとして掲載された。348
なお、8月上旬に発表された、より大規模なGLM-5.3とは混同しない方がよい。報道では、GLM-5.3-Flashは320B-A18Bの別SKU(製品モデル)であり、より大きなGLM-5.3本体と同一モデルではないと説明されている。10
Z.aiは、GLM-5.3-FlashがGLM-5.2を上回りながら、提供コストを抑えられると説明している。公開時に示された結果では、DeepSWE v1.1で63.4を記録し、GLM-5.2の46.2を上回った。また、Z.aiの社内コーディングベンチマークでは29.0で、Claude Opus 4.8について報告された29.5に近い数値だった。316
これらはZ.aiがどの市場を狙っているかを示す材料にはなるが、Anthropicのモデルと同等であることを第三者が独立に確認したわけではない。ベンチマークの定義、評価条件、プロンプト、再現性の情報によって結果の意味は変わるからだ。
現時点で慎重に言えるのは、Z.aiが「大幅に低いコストで、強力なコーディング・エージェント性能を提供できる」と主張しているということだ。GLM-5.3-Flashがクローズドな最先端モデルを全面的に上回った、と結論づける材料ではない。
Ox Alphaの大きな特徴は、匿名モデルとして無料で試せたことだった。しかし、正式名称が付与された段階で、その無料プレビューは終了した。Z.aiが示した通常価格は、入力100万トークンあたり0.15ドル、出力100万トークンあたり0.50ドルである。13
一方、公開直後のOpenRouterでは、入力100万トークンあたり0.075ドル、出力100万トークンあたり0.25ドルという低いプロモーション価格が表示されていた。2 ここでは、無料プレビュー、Z.aiの通常価格、プラットフォーム限定のローンチ割引を区別する必要がある。
価格の安さは、単なる宣伝文句ではない。コーディングエージェントは、コードベースの読み込みや試行錯誤によって大量の入力・出力トークンを消費しやすい。そのため、ベンチマークのわずかな差よりも、トークン単価、遅延、利用上限、導入のしやすさがモデル選びを左右する場面もある。
Z.aiは、GLM-5.3-Flashが中国製AIアクセラレーターだけで稼働していると説明した。15 提供基盤についての報道では、SGLangを基盤にしたカスタム推論スタックに、量子化、テンソル並列、複数形式のキャッシュ、レイヤー分割などの技術を組み合わせたとされる。さらに、エンコード、プリフィル、デコードを分離する構成によって、エンドツーエンドの提供性能を高めることを目指したという。25
これは、GLMファミリーをめぐるZ.aiの従来の説明ともつながる。同社は以前から、NVIDIA製ハードウェアを使わず、Huawei AscendプロセッサーでGLMファミリーを学習したと説明してきた。また、Z.aiは米国のEntity List(輸出管理対象の企業リスト)に掲載されており、NVIDIAのH100、H200、B200へのアクセスが制限されていると報じられている。26
もっとも、今回の推論性能について、ハードウェア間の完全に監査された比較が示されたわけではない。より確実な意味は、Z.aiがNVIDIAの先端データセンターGPUに依存せず、大規模なマルチモーダルモデルを提供できる推論基盤を構築したと打ち出している点にある。
今回の流れは、意図的なステルス公開のパターンに見える。まず提供元を明かさずに性能の高いモデルを公開し、人気のあるコーディング経路で無料提供する。開発者の使い方や負荷を観察したうえで、十分な注目が集まった段階で正式名称と出自を明らかにする、という手順だ。
Z.aiは以前にも、「Pony Alpha」という名称で似た発想のテストを行ったとされる。Ox Alphaをめぐっては、コミュニティの調査者がトークナイザーの挙動、動画処理の特徴、APIエラーのパターンなどから正体を推測しようとした。71113
リリース時には非常に大きな利用量や開発者の熱狂を伝える報告も出たが、提示された数字や発言のすべてを独立に検証できる資料は確認できない。したがって、これらは監査済みの導入実績ではなく、リリース時の報道として扱うのが妥当だ。14
GLM-5.3-Flashの公開だけで、Z.aiがOpenAIやAnthropicを最先端モデルの全領域で追い抜いたことにはならない。一方で、マルチモーダル入力、長大なコンテキスト、MITライセンスのオープンな重み、コーディングエージェントへの最適化、低価格APIを一つの製品に組み合わせた点は大きい。1540
開発者にとっては、モデルの乗り換えや複数プロバイダーの併用、自社環境での運用を検討しやすくなる。クローズドモデルの提供企業にとっては、価格と利益率への圧力が強まる可能性がある。
特にコーディング用途では、ランキング上の順位だけが判断材料ではない。大量のトークンを処理できる価格、応答速度、デプロイの自由度、利用できるハードウェア、そして重みを自分で管理できるかどうかが同じくらい重要になる。Ox AlphaからGLM-5.3-Flashへの移行は、Z.aiがその現実的な競争軸を、匿名プレビューという形で先に試した出来事だった。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
Z.aiは2026年8月26日、OpenRouterとOpenCodeで匿名提供していた「Ox Alpha」がGLM 5.3 Flashだったと明らかにした。総パラメータ数は3,200億、1トークンあたりのアクティブパラメータは180億で、重みはMITライセンスで公開された。
Z.aiは2026年8月26日、OpenRouterとOpenCodeで匿名提供していた「Ox Alpha」がGLM 5.3 Flashだったと明らかにした。総パラメータ数は3,200億、1トークンあたりのアクティブパラメータは180億で、重みはMITライセンスで公開された。 GLM 5.3 Flashはテキスト・画像・動画をネイティブに入力でき、約100万トークンのコンテキストに対応する。Z.aiの公称価格は入力100万トークンあたり0.15ドル、出力100万トークンあたり0.50ドル。
匿名かつ無料のプレビューは、開発者の実際の利用を集める大規模な負荷試験であると同時に、正式発表前の関心を高めるマーケティング施策として機能した。