近日,阿里巴巴正式宣佈Qwen-Audio-3.0系列語音模型在千問AI平臺全面上線。此次發佈的系列模型包括語音識別大模型Qwen-Audio-3.0-ASR、語音合成大模型Qwen-Audio-3.0-TTS以及實時語音交互對話模型Qwen-Audio-3.0-Realtime。

據官方介紹,該系列模型在全球權威AI評測平臺Artificial Analysis今年7月的語音排行榜中表現卓越,一舉奪得語音識別(ASR)、實時交互(RealTime)和語音合成(TTS)三個核心賽道的全球第一,實現“大滿貫”。

QQ20260817-155736.jpg

在能力方面,Qwen-Audio-3.0-ASR支持複雜語境與專業領域識別;Qwen-Audio-3.0-TTS支持多語種、多方言,並能精準控制情緒、語氣與節奏;Qwen-Audio-3.0-Realtime則實現了端到端語音理解與對話,支持隨時打斷追問及工具調用,目前已應用於千問App、千問辦公及Qoder等產品。

此外,千問AI平臺近期密集更新了多款主力模型,包括Qwen3.8-Max、Qwen-image3.0pro及Wan3.0等,形成了覆蓋文本、代碼、語音、圖像和視頻的全模態模型矩陣。平臺同步推出Token Plan訂閱服務限時優惠,個人版最低39元/月起,團隊版最高可享7.6折,旨在降低開發者調用門檻,打造“爲Agent而生”的AI生產力平臺。