快手可灵AI升级至3.0版本,通过多模态一体化输入输出,重构AI视频创作流程,推动“人人皆可导演”时代到来。其核心突破在于视频生成从“片段生成”升级为“深度叙事”,并全球首创多图/视频主体参考功能,使创作者能精准锁定并控制视频主体。
昆仑万维开源视频生成大模型SkyReels-V3,实现参考图像转视频、视频延长及音频驱动虚拟形象三大功能集成。该模型支持1至4张参考图输入,能精准保留主体身份与构图,推动视频生成技术进入高保真、多模态新阶段。
生数科技开放Vidu视频大模型Q1参考生图功能,突破多主体一致性技术瓶颈,实现AI图像与视频生成的商业闭环,推动多模态创作进入新阶段。该功能支持同时输入7张参考图,显著增强创作可控性,并具备多主体、多场景的强大生成能力。
生数科技在WAIC2025发布Vidu Q1"参考生视频"功能,实现视频制作流程革新。该功能允许用户上传参考图配合文字提示直接生成视频,简化传统制作流程,最多支持7个主体同时输入并保持一致性。采用U-ViT架构结合扩散模型技术,重点解决商业化主体一致性问题。同时,公司与清华大学合作推出具身智能模型Vidar,通过视频大模型实现低成本机器人动作转化。目前公司仍以提升视频生成能力为主要方向,同时探索具身智能的商业应用前景。
Anthropic
$21
Input tokens/M
$105
Output tokens/M
200
Context Length
Google
$0.14
$0.28
131
Minimax
-