谷歌发布视频生成AI模型Gemini Omni1.1 Flash,最高支持4K超高清输出,并在场景扩展、运镜控制与生成效率上全面升级,面向开发者和专业创作者。该模型主打多项功能亮点,用户可直接进行场景扩展等操作,推动多模态视频生成向更高清、更长时方向演进。
超算互联网AI社区推出免费AI视频生成智能体“光影智创”,基于MiniMax-H3满血版模型,依托国产算力免本地部署。支持文字与参考图输入,单次可直出最长15秒768P高清视频。
MiniMax推出全模态生成模型H3,承诺近期全面开源。该模型支持文本、图像、视频、声音任意组合输入,可生成带原生双声道音频的高清视频,用户只需提供参考素材即可驱动创作。
AI产业急速扩张加剧全球能源与水资源压力。国家能源局局长指出,生成5秒AI高清视频耗电可充满10部手机,提问10次约消耗一瓶矿泉水。近期全球能源市场动荡、多国供应紧张,AI算力需求激增使局面更严峻。AI的高能耗与高水耗正成为新型能源体系规划需应对的关键挑战。
专业AI视频生成器,可从文本或图像创建4K高清视频
免费AI图像转视频生成器,秒速将图像转为高清视频,无水印。
免费在线AI视频生成器,可秒将文本或图像转为高清视频
Grok Imagine Video 1.5可将静态图像转化为720p高清视频片段
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$2.1
$17.5
Alibaba
$2
$20
-
$8
$240
52
$3.9
$15.2
64
$15.8
$12.7
Bytedance
$0.8
256
Baidu
Tencent
24
32
jayn7
腾讯混元视频1.5模型的量化GGUF版本,专门用于文本到视频生成任务,支持720P高清视频生成,提供多种量化精度版本以优化使用效率。
egorchistov
MEMFOF是一种内存高效的光流估计方法,专为全高清视频设计,结合了高精度和低显存使用。
Skywork
SkyReels V2是一个无限长度电影生成模型,采用自回归扩散强制架构,支持720P高清视频生成,在公开模型中达到SOTA性能。
OpenGVLab
InternVideo2-Chat-8B-HD 是一个结合了大型语言模型和视频BLIP的视频理解模型,通过渐进式学习方案构建,能够处理高清视频输入。