DeepSeek V4 Flash 及 V4 Pro API 價格按模型、Token 類型、快取狀態及時段上調 50% 至 1,100% 以上;繁忙時段價格是非繁忙時段的兩倍。 兩間公司的出招方向不同:DeepSeek 將龐大開發者需求變現並管理有限算力,OpenAI 就以 ChatGPT 免費文字聊天保住用戶習慣及產品分發。
研究答案

Create a landscape editorial hero image for this Studio Global article: How did the latest pricing and access decisions by DeepSeek and OpenAI illustrate the intensifying US–China AI competition, and what were th. Article summary: These moves show competition shifting from a simple “cheapest model wins” contest to a two-front battle: Chinese providers are monetizing enormous developer demand while retaining major cost advantages, and OpenAI is def. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
DeepSeek 同 OpenAI 最近的價格及產品政策,顯示 AI 競爭已經由單純「邊個模型最平」變成多線作戰:一邊比拼推理成本、算力容量及開發者採用率,另一邊就爭奪消費者入口、使用習慣及產品生態。
DeepSeek 將 V4 API 改為繁忙及非繁忙時段收費;OpenAI 則把 GPT-5.6 Luna 設為 ChatGPT Free 及 Go 用戶的預設模型,並提供不限量日常文字對話。兩項決定放在一起看,正好反映中美 AI 供應商面對的兩種商業壓力。
DeepSeek 於 8 月 13 日宣布上調 V4-Flash 及 V4-Pro API 價格。新收費在 8 月 16 日 16:00 UTC 起生效,即北京時間 8 月 17 日,並以繁忙及非繁忙時段取代原本的劃一價格。
繁忙時段為 UTC 01:00 至 04:00,以及 06:00 至 10:00,每日合共 7 小時;其餘 17 小時屬非繁忙時段。繁忙時段收費是新非繁忙時段價格的兩倍。
以下價格以美元計算,每 100 萬個 Token 收費:
| 模型 | 時段 | 輸入(命中快取) | 輸入(未命中快取) | 輸出 |
|---|---|---|---|---|
| V4-Flash | 非繁忙 | $0.007 | $0.22 | $0.66 |
| V4-Flash | 繁忙 | $0.014 | $0.44 | $1.32 |
| V4-Pro | 非繁忙 | $0.022 | $0.66 | $1.98 |
| V4-Pro | 繁忙 | $0.044 | $1.32 | $3.96 |
實際加幅視乎模型、Token 類型、快取是否命中及使用時間而定。路透社形容,整體新價格較舊價高出 50% 至 1,100%。
對大量產生輸出的工作負載,影響尤其明顯。V4-Pro 輸出價格由每 100 萬 Token $0.87,升至非繁忙時段 $1.98,繁忙時段更是 $3.96。
換句話說,一個每月產生 1,000 萬個輸出 Token 的編程代理,單計輸出費用,舊價約為 $8.70;如果全部安排在非繁忙時段,約為 $19.80;若全部落在繁忙時段,就約要 $39.60,還未計輸入 Token 費用。
新收費令「幾時送出請求」變成成本管理的一部分。批次處理、程式碼代理、模型評估等不急於即時完成的工作,可以嘗試安排到每日 17 個非繁忙小時內運行。不過,面向用戶的互動式應用程式通常較難彈性調動,因為請求往往在用戶需要答案時才到達。
快取及模型路由亦會變得更加重要。開發團隊可以透過提高快取命中率、將一般工作交給 V4-Flash,或者把部分請求轉送其他供應商,減低新價格帶來的衝擊。對企業而言,揀模型已不再只是一次性的基準測試比較,而是涉及延遲、流量調度及營運風險的長期決定。
加價並沒有完全抹走 DeepSeek 的成本優勢,但就收窄了它靠超低推理成本吸引大量使用的空間。引入繁忙時段收費,與供應商嘗試管理需求、提高有限運算容量回報的做法一致。不過,現有報道未能證明 DeepSeek 已經盈利,亦未提供一條獲確認的盈利路徑,因此這個商業解讀仍然只能保持審慎。
OpenAI 採取的是另一種策略。公司在 8 月 6 日宣布,GPT-5.6 Luna 將成為 ChatGPT Free 及 Go 用戶的預設模型,取代 GPT-5.5;兩個方案亦會獲得不限量日常文字對話,以及讓用戶處理較難問題的 Think 選項,但仍受防止濫用的安全措施約束。
不過,「不限量」並不是整個 ChatGPT 都無上限。檔案上載、圖片生成、語音及其他工具,仍然有各自的使用限制。Free 及 Go 用戶亦不包括 GPT-5.6 Sol;Luna 才是這兩個方案的預設模型,並負責 Think 功能。
Luna 在 GPT-5.6 家族中定位較為經濟,並非旗艦 Sol。第三方報道列出的 Luna API 價格為每 100 萬輸入 Token $0.20、輸出 Token $1.20,但在現有資料中,這組數字未獲最高權威來源確認,因此不宜把它當作已完全核實的官方比較。
真正重要的戰略分別是:Luna 在 ChatGPT Free 及 Go 內可供文字聊天使用,對用戶而言近乎免費;但 API 仍然是另一項需要付費的開發者產品。
兩間公司出招之際,中國模型正吸引大量開發者流量。彭博報道,中國模型在 6 月首次在 OpenRouter 上超越美國平台,並在其後一個月佔超過 60% Token 份額。
OpenRouter 是一個讓開發者接入及路由多個 AI 模型的平台,因此可以用來觀察開發者如何分配模型流量,但它並不是全球 AI 使用量的完整統計。
7 月 OpenRouter 排名更顯示,按 Token 用量計算,前五位模型全部由中國團隊開發:小米 MiMo-V2.5、DeepSeek、MiniMax、阿里巴巴 Qwen 家族,以及 Moonshot 的 Kimi。 另一項分析則指,DeepSeek 在 6 月其中一個排名中是平台最大單一供應商,佔 17.6% 份額。
這種流量分布解釋了為何 API 價格仍然是核心戰場。對需要反覆執行的編程及代理工作來說,模型夠平,才有可能大規模運行。同時,OpenAI 的做法亦說明,爭取使用量不一定只靠 API 減價:把能力足夠的模型放到免費用戶面前,可以培養日常使用習慣,並為日後轉用付費產品提供入口。
DeepSeek 同 OpenAI 其實是在回應同一個市場問題:AI 的算力成本及使用需求都在上升,但兩間公司選擇了不同方向。
所以,即使部分價格上升,AI 價格戰亦未必代表完結。相反,競爭正逐步分層:中國供應商較多在低成本推理、開放權重及高 Token 流量上競爭;美國供應商就較集中於消費者覆蓋、產品整合、旗艦能力及企業控制。
DeepSeek 加價提醒市場,超低 API 價格可以帶來龐大使用量,但不代表成本會永久維持在同一水平。OpenAI 將 Luna 免費提供給廣大用戶,則是另一種押注:先補貼大規模消費者體驗,鞏固分發渠道,再透過模型等級及非文字功能作出區隔。
對開發者及企業買家來說,最實際的教訓是,不要把任何一張價目表或一次基準測試結果當成永久答案。成本會隨需求、模型層級、快取狀態及時間改變。較穩健的做法,是以真實工作負載持續量度成本,保留多供應商路由選項,再按每項工作的風險、性能要求及預算,配對合適的模型和使用方案。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
DeepSeek V4 Flash 及 V4 Pro API 價格按模型、Token 類型、快取狀態及時段上調 50% 至 1,100% 以上;繁忙時段價格是非繁忙時段的兩倍。
DeepSeek V4 Flash 及 V4 Pro API 價格按模型、Token 類型、快取狀態及時段上調 50% 至 1,100% 以上;繁忙時段價格是非繁忙時段的兩倍。 兩間公司的出招方向不同:DeepSeek 將龐大開發者需求變現並管理有限算力,OpenAI 就以 ChatGPT 免費文字聊天保住用戶習慣及產品分發。
中國模型在 OpenRouter 的 Token 流量於最新報道時段超過 60%,但這只反映開發者路由市場,並不等於全球整體 AI 使用量。