近日,字节跳动 Seed 团队正式推出了全新一代视频创作模型
在视频时长与叙事表现上,

面对复杂的创作需求,
此外,该模型在剪辑和可控性方面同样表现亮眼。平台支持通过时间戳进行精准的内容编辑,无论是画面视角、运镜节奏,还是绿幕背景下的物理效果渲染,创作者都能进行定向修改,从而显著降低反复生成和后期拼接的成本。
目前,
近日,字节跳动 Seed 团队正式推出了全新一代视频创作模型
在视频时长与叙事表现上,

面对复杂的创作需求,
此外,该模型在剪辑和可控性方面同样表现亮眼。平台支持通过时间戳进行精准的内容编辑,无论是画面视角、运镜节奏,还是绿幕背景下的物理效果渲染,创作者都能进行定向修改,从而显著降低反复生成和后期拼接的成本。
目前,
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
科大讯飞发布语音基座大模型Spark-Audio-1.0-Preview,基于全国产算力训练,降低供应链风险。模型支持文本和语音输入、文本输出,具备语音转写、多语言翻译、多方言识别、环境音识别、说话人识别、情感分析及音频问答等能力。

科大讯飞上线语音基座大模型Spark-Audio-1.0-Preview,基于全国产化算力训练。传统音频处理多采用级联方案,先转文字再理解,存在信息丢失(忽略语气、情绪、背景环境音)和链路割裂(语音转写、声纹识别等环节分离)两大短板,影响场景判断完整性。
9月16日,阿里千问Qwen3.8-27B在Hugging Face最受欢迎开源大模型榜单登顶,超越FLUX.1、DeepSeek-R1、Kimi-K3、Meta-Llama-3等。该榜以开发者点赞为评选口径,反映真实偏好,而非跑分或参数规模,成社区史上最受欢迎开源模型。

努比亚NaviX Ultra上市,搭载豆包手机助手消费者版,标志AI智能体手机进入规模化量产商用。主打“听得懂、能干活、记得住、够安全”,支持一键唤醒、连续语音、复杂任务自主执行、个人记忆。配指纹AI按键,通话接入Seed全双工语音大模型,可随时打断、连续对话,支持闽南语、客家话等方言。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、豆包2.1Pro0915上线火山方舟,飞书8.0引入团队智能体“豆包工作伙伴”字节系企业生产力产品推出重大更新,火山引擎升级豆包大模型至0915版本,并优化API接入;飞书发布8.0版本,引入团队智能体“豆包工作伙伴”,推动AI从个人助手向团队协作转变。8、Google官宣Gemini3.8Live,首创“边说边想”颠覆行业交互Google宣布推出Gemini3.8Live及其扩展版本,实现了语音交互领域的重大突破,特别是在低延迟语音流中实现深度推理能力,为语音人工智能应用带来了全新的变革。

谷歌发布全球语言智能新成果:AI支持超300种语言,覆盖71亿人口、86%比例。谷歌称语言大模型不应只做文本翻译,还需理解语气、情感与文化细微差别;同时指出传统语音识别多步刚性管线存在局限。

生数科技9月15日发布Vidu S2视频大模型系列,含两个核心模型:Vidu S2-Avatar用于持续交互数字角色生成,Vidu S2-Editing用于输入视频流实时编辑。此外还探索VR头显实时空间视频生成与编辑。全链路研发由朱军教授博士生、流式视频生成与推理负责人张金涛负责。
vivo发布智能体大模型矩阵,涵盖语音、端侧、云侧等四款核心模型,全面赋能终端智能化体验。同时预研蓝心30B MoE端侧大模型,探索万亿级能力落地手机,提升多模态理解、长链推理与复杂任务自主执行,并同步推进软件与系统生态建设。
9月16日,火山引擎宣布豆包大模型2.1Pro升级至0915版本,API全量上线火山方舟;豆包客户端同步更新,用户可选新版体验。TRAE已接入,Doubao-Seed-Evolving也升级同版本,企业无需更换API接口。
OpenAI正就新一轮私募融资与投资者初步洽谈,目标估值高达1.2万亿美元。此次融资背景是GPT-5.6、Astra等新模型发布,推动营收加速增长。今年3月其刚完成1220亿美元融资,投后估值8520亿美元,新目标估值较此前大幅跃升。目前谈判仍处早期阶段。