千問發佈語音合成大模型Qwen-Audio-3.0-TTS,主打Free-style自然語言指令控制,用戶無需調整工程參數,僅用日常語言描述即可讓AI按指定語氣、節奏、風格說話,極大簡化操作門檻。
阿里通義千問發佈新一代實時語音合成模型Qwen-Audio-3.0-TTS,實現從“能說話”到“會表達”的跨越。Plus版本在Artificial Analysis Speech Arena排名全球第一,超越Gemini3.1TTS等主流模型。雙版本中Flash版主打低延遲實時交互(首包約300ms),Plus版專攻高質量自然度與音色還原。