語音識別大模型迎來重要技術升級。9月23日,科大訊飛官方正式發佈了全新一代語音識別大模型 Spark-ASR-2.0,標誌着其在語音交互與智能硬件落地方面邁出了關鍵一步。
在具體的上線與落地節奏方面,該模型將於次日(9月24日)起在訊飛輸入法中逐步上線,同時通過訊飛開放平臺面向開發者與企業客戶全面提供 API 服務。此外,Spark-ASR-2.0還將陸續在訊飛 AI 眼鏡、訊飛智能辦公本、訊飛聽見等一系列核心軟硬件產品業務中深度落地,持續拓展聲學大模型在多元場景中的應用邊界。

語音識別大模型迎來重要技術升級。9月23日,科大訊飛官方正式發佈了全新一代語音識別大模型 Spark-ASR-2.0,標誌着其在語音交互與智能硬件落地方面邁出了關鍵一步。
在具體的上線與落地節奏方面,該模型將於次日(9月24日)起在訊飛輸入法中逐步上線,同時通過訊飛開放平臺面向開發者與企業客戶全面提供 API 服務。此外,Spark-ASR-2.0還將陸續在訊飛 AI 眼鏡、訊飛智能辦公本、訊飛聽見等一系列核心軟硬件產品業務中深度落地,持續拓展聲學大模型在多元場景中的應用邊界。
科大訊飛上線語音基座大模型Spark-Audio-1.0-Preview,基於全國產化算力訓練。傳統音頻處理多采用級聯方案,先轉文字再理解,存在信息丟失(忽略語氣、情緒、背景環境音)和鏈路割裂(語音轉寫、聲紋識別等環節分離)兩大短板,影響場景判斷完整性。
科大訊飛發佈星火X2.5大模型,採用MoE架構,參數規模293B-A30B,重點提升代碼與智能體能力,並增強數學、理解等通用能力。該模型基於全國產算力完成訓練推理,優化國產超長序列訓推難題,已上線訊飛開放平臺。端側4B和1.7B模型已先行開源,支持最長100萬Token上下文。
近日,中科院大連化物所聯合科大訊飛、阿里雲發佈智能化工大模型3.0 Pro。作爲我國化工行業首個大模型的最新迭代版,其發佈標誌着行業大模型正告別單一知識問答,向更深層次工業落地邁進;技術上從過去聚焦信息檢索與內容生成,跨越到全新階段。
科大訊飛9月1日將開源星火X2.5-4B和1.7B兩款端側通用大模型,原生支持1M token長上下文,重點提升智能體交互、數學計算與通用理解能力,面向車載、智能硬件及萬物互聯等端側場景。9月7日還將發佈更大規模模型。
科大訊飛在2026年半年度業績說明會上透露,將於今年1024開發者節正式推出基於全國產算力的全新主力通用大模型;8月底率先發布階段性版本,供市場和開發者提前體驗,技術落地節奏已明確。