字节跳动发布音频创作模型Seed Audio1.0,已在火山方舟开放测试。它打破传统影视音频需多模型分别生成人声、音效与环境声再人工拼接的冗长流程,实现声音场景一体化创作,确保叙事一致性,标志着AI音频生成进入完整声音场景新阶段。
智能眼镜厂商Innovative Eyewear推出Lucyd应用重大更新,新增AI实时翻译通话功能。用户佩戴兼容设备后,可用母语与全球伙伴对话,对方接收音色自然、声线一致的翻译语音。这标志着智能眼镜从硬件竞争转向语音AI平台生态博弈,打破语言障碍,推动跨地域协作。
抖音生活服务发布《AIGC创作规范》,为AI生成内容划定法律与道德边界。核心要求包括:保障消费者知情权,创作者需显著标注AI生成或深度合成内容,主动声明科技属性,不得隐瞒;同时严打“换脸仿声”等侵权人格行为,明确版权红线。
抖音生活服务发布《AIGC创作规范》,要求创作者使用人工智能或深度合成技术时,须保障消费者知情权,主动声明内容含生成合成成分;使用他人肖像、声音、作品需获合法可追溯授权,并明确禁止违规行为。
免费创建带声音视频,输入想法或图片,几分钟获电影级AI视频
Stable Audio 3在线工作台,可用于AI音乐、声音设计、音频修补等
Sora 2是AI视频与音频生成平台,可依文本生成带声音的逼真视频
通过先进的AI生成专业音乐,轻松创作版权免费的节拍、旋律和声音,适合创作者和音乐人。
Alibaba
-
Input tokens/M
Output tokens/M
Context Length
$8
$240
52
Bytedance
Baidu
Tencent
$2
Anthropic
$105
$525
200
Chatglm
128
一个为macOS提供全面音频播放功能的MCP服务器,支持系统声音、文本转语音和自定义音频文件播放,适用于AI助手等MCP客户端。