相關推薦
阿里Qwen-Audio-3.0系列語音模型上線千問AI平臺,斬獲國際評測“大滿貫”
阿里巴巴在千問AI平臺全面上線Qwen-Audio-3.0系列語音模型,涵蓋語音識別、語音合成和實時語音交互三款。官方稱,該系列在權威評測平臺Artificial Analysis今年7月語音排行榜中表現卓越,包攬語音識別、實時交互和語音合成三項第一。
Aug 17, 2026
266.9k
騰訊混元 Hy ASR3.0 預覽版發佈:從"聽清"到"聽懂",方言詞錯率壓到 3%
騰訊混元發佈語音識別模型Hy ASR3.0 Preview,基於大語言模型Hy3,融合高精度識別與深度語義理解,實現從“逐字轉寫”到“理解語境”的質變。模型覆蓋十大方言片區,長音頻場景優勢突出,不依賴標準普通話,讓AI不僅能聽清字,更能真正聽懂話。
Aug 5, 2026
263.2k
騰訊混元發佈Hy ASR3.0preview:語音識別邁入“懂語境”新階段
騰訊混元發佈語音識別模型Hy ASR3.0preview,首次將大語言模型Hy3的語義理解融入識別,實現從逐字轉寫向“理解語境、一鍵直出”跨越。在開源評測集上,中文普通話、英語、粵語詞錯誤率分別爲3.34%、2.62%、3.12%,整體約3%,多維度表現亮眼。
Aug 4, 2026
298.8k
聚焦語音Agent可靠性:xAI正式發佈Grok Voice Think Fast 2.0
xAI發佈新一代語音模型Grok Voice Think Fast 2.0,全面向開發者開放,在智能水平、轉錄精度、對話交互和工具調用效率上顯著提升。定價每分鐘0.08美元,在Artificial Analysis基準測試中綜合得分爲82.9%,超越前代及GPT-Realtime-2.1、Gemini 3.1 Flash。
Jul 31, 2026
360.7k
通義千問重磅升級:實時語音識別模型 Fun-ASR-Realtime 正式發佈
通義千問推出實時語音識別模型Fun-ASR-Realtime,首字延遲降至百毫秒級,實現“即說即反饋”的流暢交互。其識別準確度接近離線模型,在保證高精度同時突破實時性瓶頸,標誌語音交互體驗邁向新高度。
Jul 6, 2026
248.2k
VIP會員