OpenAI 2026年第一季收入$57億,但現金燒咗$37億——超過收入嘅65%,營運虧損高達$93億,研發開支$86億。 公司推出「多模型路由」軟件優化,將簡單查詢分去平價模型,複雜任務先用頂級模型,推理成本可慳30 75%;另設Batch API畀等得嘅客半價。
研究答案

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What cost-cutting software optimization did OpenAI recently develop to reduce inference costs by. Article summary: ## Software Optimization: Hybrid Multi-Model Routing. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
OpenAI 2026年第一季嘅財務數字令人睇到眼突:公司賺咗$57億收入——大約係舊年同期嘅三倍——但同一時間燒咗$37億現金 。換句話講,每賺一蚊就有超過六毫半用咗喺營運上。單季營運虧損達$93億,研發開支更去到$86億
。
呢啲數字由《The Information》引述股東文件報道,反映出AI行業嘅核心矛盾:需求爆炸性增長,但仲未轉化為可持續利潤 。問題仲緊要啲,因為消息指OpenAI同Anthropic都喺2026年中秘密提交咗IPO申請,迫住要向投資者展示一條可行嘅盈利路徑
。
OpenAI為咗降低推理成本超過一半而研發嘅軟件優化方法,就係多模型路由(multi-model routing)。呢項技術會自動將簡單嘅查詢分流去較細、較平嘅模型,而最強大(亦最貴)嘅模型就留返處理複雜請求 。
業界指南指出,呢種混合方法喺模型層面可實現30-75%嘅成本削減,善用量化、蒸餾同埋「啱用先啱」嘅模型選擇,再配合批次處理、投機解碼同KV快取等運行時優化,吞吐量可提升40-80% 。OpenAI更將呢個概念商品化,推出Batch API延遲推理享半價優惠——客戶如果肯等最多24小時攞結果,價格即刻減半
。
《The Information》引述OpenAI工程師話,呢啲優化技術勁到一度可以只用「幾百張NVIDIA GPU」就serve到ChatGPT畀未登入嘅訪客 。
2026年6月24日,OpenAI聯同Broadcom正式發布Jalapeño——OpenAI第一粒自家研發嘅推理晶片 。重點如下:
OpenAI形容呢粒晶片係「多年自研晶片路線圖嘅第一塊積木」,目標係建立自己嘅運算堆疊,打破NVIDIA嘅定價主導權 。晶片係垂直整合嘅——OpenAI只會用嚟做自己嘅推理工作,唔會賣畀外部客戶
。
從Q1 2026股東文件睇到嘅關鍵數字:
公司嘅營運利潤率大約係**-122%,即係每賺一蚊就要蝕大約$1.22 。成個2025年計,OpenAI總共蝕咗大約$385億**,開支$340億
。
OpenAI嘅慳錢行動,正正係整個行業價格戰嘅縮影:
軟件同硬件雙管齊下,OpenAI有望喺擴張嘅同時將推理成本砍半。但公司唔係喺真空入面做嘢。成個推理定價嘅崩盤——由競爭對手、開源替代方案同專用硬件推動——意味住整個行業嘅定價能力正在削弱 。
對企業嚟講,呢個係好消息:運行AI工作嘅實際成本跌得快過能力增長。OpenAI嘅Batch API已經畀出50%折扣畀等得嘅工作,而多模型路由可以喺唔影響質素嘅情況下慳40-60%成本 。問題係,喺一個中國開源模型用幾分之一嘅價錢就提供到前沿能力嘅市場入面,仲有冇供應商可以維持溢價收費
。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
OpenAI 2026年第一季收入$57億,但現金燒咗$37億——超過收入嘅65%,營運虧損高達$93億,研發開支$86億。
OpenAI 2026年第一季收入$57億,但現金燒咗$37億——超過收入嘅65%,營運虧損高達$93億,研發開支$86億。 公司推出「多模型路由」軟件優化,將簡單查詢分去平價模型,複雜任務先用頂級模型,推理成本可慳30 75%;另設Batch API畀等得嘅客半價。
6月24日聯同Broadcom發布自研Jalapeño ASIC推理晶片,專為LLM推論設計,成本比NVIDIA GPU低約50%,目標2026年底大規模部署,每年可慳$5億至$10億。