9 月 1 日,科大訊飛全資子公司詞元星火正式推出並開源星火 X2.5-4B 和星火 X2.5-1.7B 兩款端側通用大模型。這兩款產品也是端側模型中首個原生支持最長 100 萬 Token 上下文的模型,同時已全面開放模型權重、代碼倉庫和部署文檔。
百萬級上下文加持,小模型也能“讀全書”
兩款模型均採用混合注意力架構,圍繞智能體、代碼、數學和指令遵循等核心能力進行優化,綜合實測能力領先業界同尺寸一流開源模型。
在上下文能力上,星火 X2.5-4B 和 1.7B 使用覆蓋長篇文檔、技術資料等場景的千億 Token 級高質量數據訓練,原生支持 100 萬 Token 上下文窗口,可以一次接收和理解更大規模的信息。

以產品售後爲例:用戶可將完整售後手冊導入星火 X2.5-4B,模型先梳理不同場景下的售後規則並標註對應章節,當被問及“購買 10 天后設備故障且使用過第三方耗材是否符合換貨要求”時,能夠關聯退換貨、故障處理和例外條件等跨章節規定給出綜合判斷。即使後續補充偏遠地區、設備存有家庭地圖等新條件,模型也能保持前文情境,結合物流、數據清除、費用承擔等規則繼續給出建議。
長上下文解決的是“信息能不能看全”,智能體和工具調用能力解決的則是“看完之後能不能動手”。星火 X2.5 端側模型可面向個人辦公、代碼開發、智能硬件和機器人等場景提供本地化智能能力。在代碼開發場景中,星火 X2.5-4B 在算法實現、代碼補全與生成等任務上可對標參數規模大 2 至 3 倍的雲端模型;在 Domux 智能家居測試集上,星火 X2.5-1.7B 的控制指令端到端執行正確率達到 90.3%,平均響應時間僅 0.85 秒;在機器人場景中,兩款模型可部署在機器人本體或邊緣設備,支持操作控制、目標追蹤、導航決策等任務,減少對雲端連接和固定預設程序的依賴。
全程國產算力訓練,即刻可下載體驗
星火 X2.5-4B 和 1.7B 均基於全國產算力平臺完成全流程訓練,使用約 20 萬億 Token 多樣化數據進行預訓練,並通過高質量監督微調和強化學習持續提升表現。
部署層面,兩款模型支持 NVIDIA、華爲、海光及後摩等硬件平臺,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,可通過 Ollama、LM Studio 等工具快速部署,並支持使用 LLaMA-Factory 開展增量訓練。即日起,模型權重已在 Hugging Face、GitHub 等平臺開放,對應模型 API 已上線訊飛星辰 MaaS 平臺,限時免費。9 月 7 日,科大訊飛還將正式發佈全新一代旗艦通用大模型星火 X2.5,進一步升級代碼和智能體等核心能力。
VIP會員