国家安全部近日发布提示,指出AI语音克隆技术带来社会秩序与财产安全新挑战。该技术仅需三至五秒音频即可精准复刻人声,普通人辨别伪造语音的成功率不足一半,且大量在线平台推出“一键”生成功能,加剧滥用风险。
Spotify在2026年投资者日推出核心AI战略载体——Studio by Spotify Labs,标志其从音频播放器转型为生成式音频平台。该桌面应用内置全能AI助理,可连接日历、邮箱、笔记,具备网页浏览与信息整理能力,并支持根据用户日程表定制个人音频内容。
谷歌宣布首款智能眼镜今秋上市,与三星、Gentle Monster及Warby Parker合作推出AI音频眼镜系列。该设备搭载专为AR/VR设计的Android XR平台,内置摄像头、扬声器和麦克风,但无显示屏。Gentle Monster和Warby Parker将在发售时提供两款设计。
ComfyUI,一家由开源项目发展而来的AI初创公司,于4月24日宣布完成3000万美元融资,估值达5亿美元。本轮由Craft Ventures领投,Pace Capital等跟投。其核心产品是基于节点的工作流平台,通过模块化框架解决主流扩散模型在生成图像、视频、音频时缺乏精确控制的问题,让用户能精细调节生成过程的每一步,与Midjourney等提示词驱动的“老虎机”式工具形成对比。
创意平台,集成各类AI模型,可快速生成影像、音频内容。
一站式AI视频、图像与音频生成创作平台
集成200+模型的视频、图像和音频AI工具,免费开启,无需切换平台
一站式 AI 视频、图像和音频生成平台。
Anthropic
$7
Input tokens/M
$35
Output tokens/M
200
Context Length
Google
$2.1
$17.5
1k
Alibaba
-
Baidu
128
Bytedance
Tencent
$2
$105
$525
32
Carla MCP服务器是一个专业的音频制作AI控制平台,通过45个工具提供完整的音频插件宿主控制,支持自然语言操作专业音频工作流程
RAGStack-Lambda是一个基于AWS Lambda的无服务器AI文档与媒体处理平台,支持上传文档、图片、视频和音频,通过OCR、转录和向量化技术构建知识库,并提供带来源追溯的AI聊天功能。采用按需付费的零闲置成本架构。
一个为AI代理提供音频播放功能的MCP服务器,可在编码任务完成时播放提示音,支持自定义音频和智能回退机制,目前主要支持macOS平台。