字節跳動發佈音頻創作模型Seed Audio1.0,已在火山方舟開放測試。它打破傳統影視音頻需多模型分別生成人聲、音效與環境聲再人工拼接的冗長流程,實現聲音場景一體化創作,確保敘事一致性,標誌着AI音頻生成進入完整聲音場景新階段。
Stability AI 發佈新一代音頻大模型Stable Audio3,並開源部分權重。該模型基於潛擴散技術,支持高品質立體聲輸出,生成速度顯著提升。提供多種規格版本,滿足音樂創作和音效製作等需求,並支持可變長度音頻生成。
Runway推出Multi-Shot App,實現從單鏡頭到全場景自動設計的跨越。用戶只需輸入場景描述,即可生成帶音效和剪輯的電影級短片,大幅簡化視頻製作流程。其核心在於智能拆解場景並自動規劃鏡頭,推動AI視頻生成進入新階段。
阿里通義實驗室推出PrismAudio框架,解決AI視頻生成中音畫不同步問題。該技術引入“思維鏈”機制,先分析視頻內容再生成匹配音效,提升沉浸感。研究已被ICLR2026收錄。
Seedance 2.5 是一款支持多模態輸入、可生成帶原生同步音效的 4K 超清 AI 視頻生成器。
創造令人驚歎的AI視頻,使用VO3 AI,這是一款先進的視頻生成器,無縫結合音效、對話和環境音效,提供沉浸式觀看體驗。
在線AI音樂生成器,幫助用戶免費創作歌曲、節拍、DJ音效等。
AISFXGen 是一個基於 AI 技術的音效生成器,支持文本和視頻生成音效。
Anthropic
$105
輸入tokens/百萬
$525
輸出tokens/百萬
200
上下文長度
Google
$0.7
$2.8
1k
$7
$35
$2.1
$17.5
$21
Alibaba
$6
$24
256
Baidu
-
128
Bytedance
$1.2
$3.6
4
$2
$3.9
$15.2
64
$0.8
$0.15
$1.5
32
Deepseek
$4
$12
Cursor AI代碼生成後播放音效的MCP實現
一個基於Model Context Protocol的通知服務,允許AI代理在任務完成時播放提示音。提供開箱即用的預置音效庫,支持跨平臺運行和自定義音效配置。
Cursor Sound MCP是一個通過MCP協議實現的音效反饋工具,在Cursor AI完成代碼生成時播放音效,提升交互體驗。
AI-StoryLab是一個基於Next.js的智能故事創作平臺,提供故事生成、語音合成、音效添加和繪圖提示詞生成功能,支持中英文內容創作。