千问发布语音合成大模型Qwen-Audio-3.0-TTS,主打Free-style自然语言指令控制,用户无需调整工程参数,仅用日常语言描述即可让AI按指定语气、节奏、风格说话,极大简化操作门槛。
阿里通义千问发布新一代实时语音合成模型Qwen-Audio-3.0-TTS,实现从“能说话”到“会表达”的跨越。Plus版本在Artificial Analysis Speech Arena排名全球第一,超越Gemini3.1TTS等主流模型。双版本中Flash版主打低延迟实时交互(首包约300ms),Plus版专攻高质量自然度与音色还原。