字节跳动发布音频创作模型Seed Audio1.0,已在火山方舟开放测试。它打破传统影视音频需多模型分别生成人声、音效与环境声再人工拼接的冗长流程,实现声音场景一体化创作,确保叙事一致性,标志着AI音频生成进入完整声音场景新阶段。
Stability AI 发布新一代音频大模型Stable Audio3,并开源部分权重。该模型基于潜扩散技术,支持高品质立体声输出,生成速度显著提升。提供多种规格版本,满足音乐创作和音效制作等需求,并支持可变长度音频生成。
Runway推出Multi-Shot App,实现从单镜头到全场景自动设计的跨越。用户只需输入场景描述,即可生成带音效和剪辑的电影级短片,大幅简化视频制作流程。其核心在于智能拆解场景并自动规划镜头,推动AI视频生成进入新阶段。
阿里通义实验室推出PrismAudio框架,解决AI视频生成中音画不同步问题。该技术引入“思维链”机制,先分析视频内容再生成匹配音效,提升沉浸感。研究已被ICLR2026收录。
Seedance 2.5 是一款支持多模态输入、可生成带原生同步音效的 4K 超清 AI 视频生成器。
创造令人惊叹的AI视频,使用VO3 AI,这是一款先进的视频生成器,无缝结合音效、对话和环境音效,提供沉浸式观看体验。
在线AI音乐生成器,帮助用户免费创作歌曲、节拍、DJ音效等。
AISFXGen 是一个基于 AI 技术的音效生成器,支持文本和视频生成音效。
Xai
$1.4
Input tokens/M
$3.5
Output tokens/M
2k
Context Length
Anthropic
$105
$525
200
Google
$0.7
$2.8
1k
$7
$35
$2.1
$17.5
$21
Alibaba
-
Baidu
128
$6
$24
256
Bytedance
$1.2
$3.6
4
$2
$3.9
$15.2
64
Cursor AI代码生成后播放音效的MCP实现
Cursor Sound MCP是一个通过MCP协议实现的音效反馈工具,在Cursor AI完成代码生成时播放音效,提升交互体验。
AI-StoryLab是一个基于Next.js的智能故事创作平台,提供故事生成、语音合成、音效添加和绘图提示词生成功能,支持中英文内容创作。
一个基于Model Context Protocol的通知服务,允许AI代理在任务完成时播放提示音。提供开箱即用的预置音效库,支持跨平台运行和自定义音效配置。