苏泊尔官方授权电商账号发布AI生成的低俗短视频,如“大叔闯入女厕”等剧情,引发网友强烈反感和品牌形象质疑。苏泊尔紧急下架全部涉事视频,承认内容管理与审核机制存在疏漏。
字节跳动发布 Seedance 2.5 视频生成模型,单次生成时长翻倍至 30 秒,将陆续上线即梦 AI、豆包专业版,API 接入火山方舟,覆盖影视、广告、教育、工业制造及自动驾驶等场景。该模型延续多模态音视频联合生成架构,重点提升长叙事、多模态参考与编辑能力,推动 AI 视频从短片段迈向长内容创作。
腾讯视频正内测AIGC平台WorkSolo,主打AI短剧、互动影视和自由画布三种创作模式。平台采用免费体验、会员订阅与积分算力结合的商业模式,使用AI功能消耗积分,会员可购买折扣加油包,并支持月付或年付订阅。
快手推出“AI互动内容”创作功能,招募首批创作者,聚焦AI互动剧情、角色对话和轻应用。这标志着短视频平台竞争从传统内容时长转向交互式体验,入选者可优先体验工具并与团队共同打磨产品。
Kuca AI视频制作器,可创作影片、短剧、广告和社交内容。
讯飞绘镜:AI短视频创作平台,4步生成视频,适配多样场景
AI 驱动,自动为多平台生成无脸短视频,含脚本、配音等。
自动创建无脸AI视频,用1300+AI元素生成可 monetizable 的4K长短视频。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$2.1
$17.5
Alibaba
$2
$20
-
$8
$240
52
$3.9
$15.2
64
$15.8
$12.7
Bytedance
$0.8
256
Baidu
Tencent
24
32
TomoroAI
TomoroAI/tomoro-colqwen3-embed-4b是一款先进的ColPali风格多模态嵌入模型,能够将文本查询、视觉文档(如图像、PDF)或短视频映射为对齐的多向量嵌入。该模型结合了Qwen3-VL-4B-Instruct和Qwen3-Embedding-4B的优势,在ViDoRe基准测试中表现出色,同时显著减少了嵌入占用空间。
TencentARC
ARC-Qwen-Video-7B是腾讯ARC实验室开发的用于理解现实世界短视频的多模态模型,基于Qwen2.5-VL-7B-Instruct构建,支持音视频同步分析和理解。
ARC-Hunyuan-Video-7B 是腾讯ARC实验室开发的多模态模型,专门用于理解现实世界中的短视频内容。它能够端到端处理视觉、音频和文本信号,通过整合多模态线索实现对视频的深度结构化理解。
chaowenguo
AnimateLCM 是一个基于扩散模型的文本到视频生成系统,能够通过文本描述生成高质量短视频片段。
google
PaliGemma 2是一款视觉语言模型(VLM),结合了Gemma 2模型的能力,能够同时处理图像和文本输入,并生成文本输出,支持多种语言。适用于图像和短视频字幕、视觉问答、文本阅读、目标检测和目标分割等多种视觉语言任务。
lzyvegetable
基于静态图像生成短视频片段的扩散模型,支持576x1024分辨率下生成14帧动态画面
weights
基于静态图像生成短视频片段的潜在扩散模型,支持1024x576分辨率25帧视频生成
vdo
Stable Video Diffusion (SVD) 1.1 是一款基于扩散模型的图像转视频工具,能够将静态图像作为条件帧生成短视频片段。
model-hub
Stable Video Diffusion(SVD)是一个扩散模型,能够以静态图像作为输入条件生成短视频片段。
一个扩散模型,可将静态图像作为条件帧生成短视频片段
thingthatis
基于静态图像生成短视频片段的扩散模型,支持576x1024分辨率25帧视频生成
开源短视频自动生成工具,整合文本转语音、自动字幕、背景视频和音乐,从简单文本输入创建专业短视频。
Shorts Video Maker是一个开源工具,用于自动化生成短视频。它结合了文本转语音、自动字幕、背景视频和音乐技术,通过简单文本输入创建吸引人的短视频内容。支持REST API和MCP协议,适用于内容创作者和开发者。