谷歌发布视频生成AI模型Gemini Omni1.1 Flash,最高支持4K超高清输出,并在场景扩展、运镜控制与生成效率上全面升级,面向开发者和专业创作者。该模型主打多项功能亮点,用户可直接进行场景扩展等操作,推动多模态视频生成向更高清、更长时方向演进。
MiniMax发布生产力工具Design,基于原生多模态视频模型H3,推动内容创作从“操作像素”迈向“操作语义”。用户只需用自然语言表达意图,系统即可自动拆解任务、调用模型完成创作,将前沿模型能力转化为可落地的商业生产力。
MiniMax开源多模态生成模型H3,摩尔线程随即基于国产智算卡MTT S5000完成极速适配。H3打破单任务局限,能融合文本、图像、音频与视频输入,精准理解创作意图,可直接生成2K分辨率、最长15秒视频。
字节跳动Seed团队发布视频创作模型Seedance 2.5,主打“一镜成片”音视频联合生成。升级亮点:单次生成时长提至30秒,支持多轮无缝延长;增强长叙事能力;融合多模态参考与后期编辑。可应用于影视、广告、教育等领域,推动多产业场景智能化创作。
多模态AI视频生成模型,支持电影级视频创作
利用 Seedance 2.0 创建令人惊叹的 AI 视频。
AI驱动的多模态内容创作平台,支持漫画、漫剧、MV等创作。
Seedance 2.5可将提示、图像等转化为结构化短视频简报,生成电影级AI视频。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
-
Anthropic
$105
$525
200
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
$8
$240
52
HuggingFaceM4
Idefics2 是一个开放的多模态模型,能够接受任意序列的图像和文本输入并生成文本输出。该模型可以回答关于图像的问题、描述视觉内容、基于多张图像创作故事,或仅作为纯语言模型使用。