9月23日,千問正式發布Qwen-Audio-3.1系列語音大模型。
本次升級不僅對語音識別(ASR)、語音合成(TTS)和實時語音交互(Realtime)三大核心模型進行了全面進化,更推出了全新的音頻創作模型Qwen-Audio-3.1-TTS-Next和音頻理解模型Qwen-Audio-3.1-ASR-Next。五款全新的語音模型同時推出,形成了一套覆蓋「理解—生成—交互—創作」的完整音頻能力棧。為進一步降低用戶使用成本,Qwen-Audio全線語音模型價格均下調,其中TTS降價約70%,Realtime降幅約85%,ASR降幅達95%。