iFLYTEK 旗下詞元星火於 2026 年 9 月 1 日開源 Spark X2.5 4B 與 X2.5 1.7B,兩款邊緣模型聲稱原生支援最多 100 萬 Token 上下文。 模型採用混合注意力架構,定位於 Agent、寫 code、數學推理、指令跟隨及本機長文件分析,可望減少將手冊或程式碼庫硬拆成多段所失去的跨章脈絡。
發布者使用 GPT-5.6 Terra 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did iFLYTEK’s wholly owned subsidiary launch and open-source on September 1, 2026 with Spark X2.5-4B and Spark X2.5-1.7B—including thei. Article summary: On September 1, 2026, iFLYTEK’s wholly owned subsidiary Ciyuan Xinghuo launched and open-sourced the edge-deployable Spark/Xinghuo X2.5-4B and X2.5-1.7B models. The company claims they are the first edge models with a na. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
詞元星火(Ciyuan Xinghuo)在 2026 年 9 月 1 日發布並開源兩款面向邊緣裝置的語言模型:Spark(星火)X2.5-4B 與 Spark X2.5-1.7B。最搶眼的規格,是兩者聲稱可在本機原生支援最長 100 萬 Token 的上下文窗口。
iFLYTEK 稱這是同類邊緣模型中首批具備此能力的產品;不過,這項「首創」定位屬公司說法,暫未見獨立測試驗證。2
兩款模型分別有 40 億及 17 億參數,採用混合注意力(hybrid attention)架構,針對 Agent/工具調用、程式編寫、數學推理及跟隨指令作調校。iFLYTEK 表示,它們可在同尺寸開源模型比較中有不錯表現,但公告未有提供獨立的對照測試結果。2
模型目標是在本機或邊緣環境運行,包括智能硬件、車載系統、機械人及物聯網裝置。這類場景未必長期有穩定雲端連線,同時亦可能受延遲與資料處理要求所限。3
處理超長文件時,常見做法是先將內容「切 chunk」:例如把產品手冊、政策文件庫或程式碼庫拆成多個細段,再按問題逐段檢索。這方法實用,但有機會漏掉另一章的例外條款、限制或相互依賴關係。
iFLYTEK 用售後服務手冊作例子:若模型能把整本手冊放入提示詞,就可跨章理解退貨、故障處理、例外情況、物流、資料清除及費用責任等規定,而不必只根據被抽出的零碎段落回答。公司將此定位為避免文件被切碎後丟失跨章脈絡的做法。2
不過,上下文窗口夠大,不等於模型必然推理可靠或答案正確。實際部署前,團隊仍要自行測試長文件檢索與理解質素、反應時間、硬件記憶體需求,以及模型能否在整份文件中正確套用相關規則。
iFLYTEK 將 Spark X2.5 定位為可協助本機生產力工作的模型,但現有發布材料未列出完整的辦公自動化功能清單,也未提供專門的辦公場景基準測試。2
至於其他用途,公司公布了以下說法:
按 iFLYTEK 的說法,兩款模型完全以中國國產算力平台訓練,使用約 20 萬億 Token 的多元預訓練資料,之後再經監督式微調及強化學習。2
公告列出的兼容項目包括:
但實際速度及記憶體佔用,會隨模型版本、量化設定、使用的上下文長度及目標硬件而大幅不同。即使模型標示支援 100 萬 Token,也不代表每部裝置都適合以該長度穩定運行。
iFLYTEK 表示,模型權重、程式碼庫和部署文件均已發布,可經 Hugging Face 及 GitHub 取得;同時亦在其 Starry MaaS 平台推出相關 API,並曾提供限時免費存取。2
6
不過,公告未說明免費期何時結束,亦未披露可用配額。打算將 API 納入產品或工作流程的開發者,應先核實當前收費與用量條款。
Spark X2.5 的賣點,不只是開源或模型較小,而是將 17 億、40 億參數的邊緣模型,與供應商聲稱的 100 萬 Token 原生上下文窗口結合。如果這項能力在實際部署中站得住腳,對需要私密地在本機分析完整手冊、技術檔案或程式碼庫,而又重視跨文件脈絡的工作,會有一定吸引力。
但最關鍵的一步仍然是實測:用具代表性的長上下文工作,以及預定採用的實際裝置與推理配置,驗證準確度、延遲和資源消耗,而非只看規格表。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
iFLYTEK 旗下詞元星火於 2026 年 9 月 1 日開源 Spark X2.5 4B 與 X2.5 1.7B,兩款邊緣模型聲稱原生支援最多 100 萬 Token 上下文。
iFLYTEK 旗下詞元星火於 2026 年 9 月 1 日開源 Spark X2.5 4B 與 X2.5 1.7B,兩款邊緣模型聲稱原生支援最多 100 萬 Token 上下文。 模型採用混合注意力架構,定位於 Agent、寫 code、數學推理、指令跟隨及本機長文件分析,可望減少將手冊或程式碼庫硬拆成多段所失去的跨章脈絡。
權重、程式碼庫及部署文件已發布,並列出多個推理框架與硬件兼容性;相關 API 曾提供限時免費,但期限及配額未有公開說明。