近日,阿里巴巴正式宣布Qwen-Audio-3.0系列语音模型在千问AI平台全面上线。此次发布的系列模型包括语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。
据官方介绍,该系列模型在全球权威AI评测平台Artificial Analysis今年7月的语音排行榜中表现卓越,一举夺得语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三个核心赛道的全球第一,实现“大满贯”。

在能力方面,Qwen-Audio-3.0-ASR支持复杂语境与专业领域识别;Qwen-Audio-3.0-TTS支持多语种、多方言,并能精准控制情绪、语气与节奏;Qwen-Audio-3.0-Realtime则实现了端到端语音理解与对话,支持随时打断追问及工具调用,目前已应用于千问App、千问办公及Qoder等产品。
此外,千问AI平台近期密集更新了多款主力模型,包括Qwen3.8-Max、Qwen-image3.0pro及Wan3.0等,形成了覆盖文本、代码、语音、图像和视频的全模态模型矩阵。平台同步推出Token Plan订阅服务限时优惠,个人版最低39元/月起,团队版最高可享7.6折,旨在降低开发者调用门槛,打造“为Agent而生”的AI生产力平台。
