相关推荐
阿里Qwen-Audio-3.0系列语音模型上线千问AI平台,斩获国际评测“大满贯”
阿里巴巴在千问AI平台全面上线Qwen-Audio-3.0系列语音模型,涵盖语音识别、语音合成和实时语音交互三款。官方称,该系列在权威评测平台Artificial Analysis今年7月语音排行榜中表现卓越,包揽语音识别、实时交互和语音合成三项第一。
2026年8月17号 16:26
266.9k
腾讯混元 Hy ASR3.0 预览版发布:从"听清"到"听懂",方言词错率压到 3%
腾讯混元发布语音识别模型Hy ASR3.0 Preview,基于大语言模型Hy3,融合高精度识别与深度语义理解,实现从“逐字转写”到“理解语境”的质变。模型覆盖十大方言片区,长音频场景优势突出,不依赖标准普通话,让AI不仅能听清字,更能真正听懂话。
2026年8月5号 16:35
263.2k
腾讯混元发布Hy ASR3.0preview:语音识别迈入“懂语境”新阶段
腾讯混元发布语音识别模型Hy ASR3.0preview,首次将大语言模型Hy3的语义理解融入识别,实现从逐字转写向“理解语境、一键直出”跨越。在开源评测集上,中文普通话、英语、粤语词错误率分别为3.34%、2.62%、3.12%,整体约3%,多维度表现亮眼。
2026年8月4号 16:41
298.8k
聚焦语音Agent可靠性:xAI正式发布Grok Voice Think Fast 2.0
xAI发布新一代语音模型Grok Voice Think Fast 2.0,全面向开发者开放,在智能水平、转录精度、对话交互和工具调用效率上显著提升。定价每分钟0.08美元,在Artificial Analysis基准测试中综合得分为82.9%,超越前代及GPT-Realtime-2.1、Gemini 3.1 Flash。
2026年7月31号 11:02
360.7k
通义千问重磅升级:实时语音识别模型 Fun-ASR-Realtime 正式发布
通义千问推出实时语音识别模型Fun-ASR-Realtime,首字延迟降至百毫秒级,实现“即说即反馈”的流畅交互。其识别准确度接近离线模型,在保证高精度同时突破实时性瓶颈,标志语音交互体验迈向新高度。
2026年7月6号 15:12
232.4k
VIP会员