2026 年 9 月 8 日開始嘅 V4.1 Flash 短期 Beta,只維持到約 9 月 10 日;正式版現時喺 API 用 deepseek flash 調用。[7][9] 新版將圖像理解原生整合到模型架構,唔使再揀以前嘅 deepseek v4 flash vision exp 實驗性視覺版本;舊名稱會暫時轉送到 V4.1 Flash。[5] Beta 期間沿用原有 API base URL、收費跟 V4 Flash,惟每個帳戶最多 20 個並發請求。網上流傳嘅每秒 300 至 500 個輸出 token 速度,並非官方保證。[7][15][20]
發布者使用 GPT-5.6 Terra 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek V4.1 Flash 最值得留意嘅,唔係曾經得兩日壽命嘅測試 endpoint,而係佢已經喺 2026 年 9 月 10 日正式成為可用嘅 API 模型。開發者而家應該使用:
deepseek-flash
DeepSeek API 更新紀錄確認,V4.1 Flash 已支援原生多模態輸入,即係文字同圖片理解係模型本身嘅能力。9
V4.1 Flash 最初喺 9 月 8 日以限時 Beta 形式開放。當時開發者毋須改 API endpoint 或 base_url,只要喺請求中改 model 欄位:
deepseek-v4.1-flash-expires-on-0910
個名稱入面嘅 expires-on-0910 已經講明,呢個係預定約於 9 月 10 日停止嘅臨時測試路線。7
20
Beta 當時嘅條件包括:
所以,呢個版本當日適合做整合測試、效果比較同早期多模態驗證,但唔適合當作長期 production 基建。現時讀到舊報道,最重要係分清楚:臨時 Beta ID 已屬歷史,正式 API 名稱係 deepseek-flash。9
V4.1 Flash 嘅核心改動,係採用新模型架構,將視覺理解直接放入模型能力之內。呢個同早前嘅 deepseek-v4-flash-vision-exp 唔同:後者係 V4 Flash 旁邊嘅實驗性視覺變體;V4.1 Flash 則把文字及圖像處理整合為同一個模型選項。5
DeepSeek 表示,為兼容既有整合,deepseek-v4-flash 同 deepseek-v4-flash-vision-exp 嘅請求會暫時轉送至 V4.1 Flash。5
官方披露,V4.1 Flash 是一個 5,520 億參數嘅混合專家(Mixture-of-Experts,MoE)模型,採用新的 Causal Encoder–Decoder 架構。輸入處理時會啟用 80 億參數,輸出生成時則啟用 160 億參數。5
對 API 使用者而言,實際意思好直接:如應用要同時處理文字同圖片,可以選用 deepseek-flash,而唔需要特登揀舊嘅 vision 實驗型號。
Beta 初期有測試者稱輸出速度約為每秒 300 至 500 個 token,亦有人聲稱超過每秒 500 個 token。15
不過,呢啲都係用戶自行觀察,唔係 DeepSeek 發布嘅服務承諾(SLA),亦唔係統一測試條件下嘅正式基準成績。提示詞長度、輸出長度、地區、同時請求量、實作方式同模型設定,都會影響吞吐量。
換句話講,速度報告可以反映部分環境下 Beta 表現似乎幾快,但唔應該直接當成寫程式、做 UI prototype,或者任何正式工作負載嘅容量保證。
DeepSeek 在 V4.1 Flash 發布時,曾表示計劃由 9 月 14 日起,將 deepseek-v4-pro 請求轉送到 V4.1 Flash,並按 V4.1 Flash 收費,直至日後推出 V4.1 Pro。官方發布亦稱,V4.1 Flash 在其公布嘅基準測試中勝過旗艦模型。5
但之後嘅 API 更新紀錄指出,DeepSeek 因應用戶需求,決定 9 月 14 日後繼續提供 V4 Pro API 服務,計費方式維持不變。9
對接入 API 嘅團隊嚟講,後一項官方更新先係目前較可靠嘅依據。模型改版期間,別名轉送、路由安排同供應狀態都可以好快改變;最好做法係以官方文件列出嘅 model name 為準,留意 API changelog,並於改動前後跑 regression test,唔好假定經別名或轉送 endpoint 得到嘅行為一定完全一樣。
| 9 月 8 至 10 日 Beta | 正式發布後 |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| 有期限嘅測試 route | 官方文件列明嘅 API 模型 |
| Beta 收費跟 V4 Flash 相同 | 以現行正式收費及服務條款為準 |
| 每帳戶上限 20 個並發請求 | 應查閱最新 API 文件確認實際營運限制 |
總結而言,V4.1 Flash 真正留下嘅重點,唔係嗰個只存在兩日嘅 endpoint,而係 DeepSeek 推出咗一個採用新架構、支援原生多模態、並有固定 API 名稱嘅 Flash 級模型。5
9
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
2026 年 9 月 8 日開始嘅 V4.1 Flash 短期 Beta,只維持到約 9 月 10 日;正式版現時喺 API 用 deepseek flash 調用。[7][9]
2026 年 9 月 8 日開始嘅 V4.1 Flash 短期 Beta,只維持到約 9 月 10 日;正式版現時喺 API 用 deepseek flash 調用。[7][9] 新版將圖像理解原生整合到模型架構,唔使再揀以前嘅 deepseek v4 flash vision exp 實驗性視覺版本;舊名稱會暫時轉送到 V4.1 Flash。[5]
Beta 期間沿用原有 API base URL、收費跟 V4 Flash,惟每個帳戶最多 20 個並發請求。網上流傳嘅每秒 300 至 500 個輸出 token 速度,並非官方保證。[7][15][20]