通义实验室发布Fun-CosyVoice3.5和Fun-AudioGen-VD两款语音大模型,支持“FreeStyle”自然语言指令生成,实现“一句话自由生成语音”的深度交互。Fun-CosyVoice3.5新增泰语、印尼语等4个语种支持,提升多语种复刻与精细化表达能力。
阿里通义实验室推出Fun-CosyVoice3.5和Fun-AudioGen-VD两款语音生成模型,支持“FreeStyle”指令,用户通过自然语言描述即可控制声音风格或构建音频场景。Fun-CosyVoice3.5专注于多语种复刻与精细化控制,是CosyVoice的升级版。
阿里巴巴通义大模型开源“百聆”系列语音模型重大升级。新模型仅需3秒录音即可无缝切换9种语言和18种方言,支持普通话、粤语、日语、英语等,并能模拟开心、愤怒等多种情感。其中Fun-CosyVoice3模型改进显著,首包延迟降低50%,中英混说准确率大幅提升。