小红书发布新一代对话合成模型 FireRedTTS-2,助力 AI 播客制作
小红书智创音频技术团队近日推出了新一代对话合成模型 FireRedTTS-2,标志着对话生成技术的又一重要进展。该模型旨在解决现有对话合成方案中存在的一些痛点,例如灵活性差、发音错误频繁、说话人切换不稳定以及韵律自然度不足等问题。FireRedTTS-2通过升级其核心模块,特别是离散语音编码器和文本语音合成模型,全面提升了合成效果。在多项主客观评测中,FireRedTTS-2均显示出行业领先水平,为多说话人的对话合成提供了更优的解决方案。其技术报告已在 arXiv 上发布,并可通过专用 De