2026年8月初,企業AI推理成本跌至年度新低,平均每百萬token僅需1.16至1.18美元,相較5月31日的2.04美元,跌幅高達43%。 這波降價主要推手包括:OpenAI於7月30日將GPT 5.6 Luna價格大砍80%、DeepSeek於7月31日推出超低價V4 Flash模型(每百萬token輸入0.14美元/輸出0.28美元),以及Anthropic Claude Opus 5的競爭性定價。
研究答案

Create a landscape editorial hero image for this Studio Global article: What caused enterprise AI inference costs to hit their lowest level in 2026 in early August, and what specific price data, trends, and compe. Article summary: Enterprise AI inference costs hit a 2026 low in early August, averaging **$1.16–$1.18 per million tokens** — a ~43% drop from $2.04 on May 31 — driven by an intensifying global price war, OpenAI's steep cuts, and the sur. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
企業AI推理成本在2026年8月初跌至年度新低,平均每百萬token(即模型處理的數據單位)的價格落在1.16至1.18美元之間,相較於5月31日的2.04美元,短短十週內大幅下降了約43%。根據投資銀行Jefferies的最新研究報告,以及矽谷數據公司Silicon Data的指數顯示,此現象是由全球日益激烈的價格戰、OpenAI的大幅降價,以及以DeepSeek為首、價格極具競爭力的中國開源模型快速崛起所共同驅動 。
Jefferies研究 — 這家投資銀行於2026年8月10日發布報告,指出企業AI推理價格已跌至今年迄今的最低點。報告引用Silicon Data的數據顯示,8月6日至8日期間,平均推理價格為1.16至1.18美元/每百萬token 。與5月31日記錄的2.04美元相比,跌幅約為43%
。
Silicon Data的LLM Token Expenditure Index — 此指數追蹤市場整體趨勢,顯示從6月初的每百萬token超過2美元,到8月第一週已降至1.20美元,兩個月內跌幅約40% 。7月27日的指數快照為1.43美元,證實了價格的持續下跌趨勢
。Silicon Data直接點名中國的開源權重模型是拉低指數均值的主要因素
。
OpenAI將API價格調降最高達80%,並歸因於基礎設施效率的提升。此舉直接壓縮了市場平均價格;CNBC與Forbes等媒體均將此舉形容為AI價格戰的升溫 。
OpenAI表示,這些降價得益於內部的優化,包括核心程式碼重寫和推測解碼技術,在推理工作負載中實現了20%至35%的效率提升 。
2026年7月31日,DeepSeek發布了V4-Flash-0731公開測試版,其定價極具破壞力:
這個價格大約是高階模型的十分之一,DeepSeek V4 Flash因此成為市場的價格地板,迫使整個市場價格進一步壓縮。根據評測機構Artificial Analysis的估計,V4 Flash執行單一任務的平均成本大約僅需3美分 。該模型在所有DeepSeek發布的代理任務基準測試中,表現甚至超越了自己的V4 Pro預覽版,而價格僅為其三分之一
。
Opus 5以每百萬輸入token 5美元和每百萬輸出token 25美元的價格進入市場——與其前輩Opus 4.8完全相同。其快速模式(Fast mode)價格為基礎價格的兩倍(輸入10美元/輸出50美元)。雖然Opus 5本身沒有降價,但它以極具競爭力的「接近前沿」等級(以一半的價格提供接近Fable 5的智慧水準)推出,此舉對競爭對手形成了壓力,並為企業提供了更多低成本選擇
。
OpenAI的80%降價(7月30日)、DeepSeek低於30美分的Flash定價(7月31日)、Anthropic極具競爭力的Opus 5推出(7月24日),以及企業對低成本中國開源模型的大量採用,共同將市場指數從5月底的2.04美元,壓縮至8月初的1.16至1.18美元——十週內跌幅高達43% 。
由Thomas Chong領銜的Jefferies分析師團隊將此下跌歸因於「日益激烈的全球價格戰」以及「價格親民的中國開源權重模型採用率激增」。市場反應不僅體現在價格上:Jefferies也認為,不斷下降的token成本可能會刺激AI需求並帶動基礎設施投資
。
Silicon Data的公開指數在7月27日顯示為1.43美元,而報導中8月初的數字為1.20美元,這暗示了7月底至8月初,在OpenAI和DeepSeek的公告推動下,價格出現了急遽下跌 。值得注意的是,該指數混合了價格和使用量數據,因此指數的下跌可能同時反映了標價下降,或市場需求向更便宜模型轉移的現象——Silicon Data本身也曾警告,不應將該指數單純解讀為「價格標籤」
。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
2026年8月初,企業AI推理成本跌至年度新低,平均每百萬token僅需1.16至1.18美元,相較5月31日的2.04美元,跌幅高達43%。
2026年8月初,企業AI推理成本跌至年度新低,平均每百萬token僅需1.16至1.18美元,相較5月31日的2.04美元,跌幅高達43%。 這波降價主要推手包括:OpenAI於7月30日將GPT 5.6 Luna價格大砍80%、DeepSeek於7月31日推出超低價V4 Flash模型(每百萬token輸入0.14美元/輸出0.28美元),以及Anthropic Claude Opus 5的競爭性定價。
Jefferies研究報告指出,全球價格戰白熱化與低價中國開源模型(如DeepSeek)的廣泛採用,是造成此波成本急墜的兩大核心因素。