相关推荐
阿里千问发布 Qwen-Audio-3.1:五款语音模型同发,ASR 价格直降 95%
千问发布Qwen-Audio-3.1系列语音大模型,全面升级语音识别、合成与实时交互,并推出音频创作模型TTS-Next与理解模型ASR-Next,五款模型覆盖“理解—生成—交互—创作”完整能力栈。同时全线降价,TTS降约70%,降低使用门槛。
2026年9月23号 16:10
115.2k
千问一口气端出五款语音大模型,TTS价格腰斩七成、ASR砍掉九成五,把耳朵和嗓子全打包给了开发者
阿里千问9月23日升级语音栈,推出Qwen-Audio-3.1系列五款模型,覆盖识别、合成、实时交互、音频创作与理解,形成“理解—生成—交互—创作”完整矩阵。价格大幅下调:TTS降约70%、Realtime降约85%、ASR降95%,大幅降低语音使用门槛。
2026年9月23号 15:49
114.1k
千问发布 Qwen-Audio-3.1系列语音大模型,五款模型全线降价最高95%
千问9月23日发布Qwen-Audio-3.1系列语音大模型,形成覆盖理解、生成、交互与创作的完整音频能力栈,含ASR、ASR-Next、TTS、TTS-Next及Realtime。API已上架千问AI平台,ASR-Next即将上线。同步全线降价:TTS约70%、Realtime约85%、ASR达95%。ASR增强多语种、方言识别与上下文理解,新增原生转写润色。
2026年9月23号 15:28
90.8k
阿里Qwen-Audio-3.0系列语音模型上线千问AI平台,斩获国际评测“大满贯”
阿里巴巴在千问AI平台全面上线Qwen-Audio-3.0系列语音模型,涵盖语音识别、语音合成和实时语音交互三款。官方称,该系列在权威评测平台Artificial Analysis今年7月语音排行榜中表现卓越,包揽语音识别、实时交互和语音合成三项第一。
2026年8月17号 16:26
265.1k
腾讯混元 Hy ASR3.0 预览版发布:从"听清"到"听懂",方言词错率压到 3%
腾讯混元发布语音识别模型Hy ASR3.0 Preview,基于大语言模型Hy3,融合高精度识别与深度语义理解,实现从“逐字转写”到“理解语境”的质变。模型覆盖十大方言片区,长音频场景优势突出,不依赖标准普通话,让AI不仅能听清字,更能真正听懂话。
2026年8月5号 16:35
266.9k
VIP会员