索尼PS6迎来技术变革,爆料称其将融合视频帧插补、独家超分辨率算法与AI光线追踪,借助AI帧生成等黑科技,目标在4K分辨率下实现120帧超高流畅度体验。
即梦AI网页版6月23日上线原生4K功能,核心突破在于直接在生成阶段以4K渲染,而非后期低分辨率放大。这项技术路径创新从源头保留了高密度细节,使人物发丝、服装纹理、建筑线条等精细元素得到更完整清晰的呈现,标志其视频生成品质的关键提升。
AI设计平台Lovart推出Touch Edit触控功能,公测48小时吸引超10万创作者。该功能通过快捷键自动识别并锁定发丝、服饰等元素,用户只需用自然语言描述修改需求,即可在4K分辨率下即时完成融合,无需手动操作。同时支持多图上传,系统自动编辑混搭。
谷歌于12月1日推出Gemini 3大模型,接入搜索AI模式,覆盖近120个国家地区,向AI Pro与Ultra订阅用户开放。同时上线Nano Banana Pro图像模型,支持2K/4K分辨率、精准文本渲染及专业级摄影控制,定价1080p为0.139美元、4K为0.24美元。Gemini 3采用原生多模态架构,统一处理文本、图像、音频和视频。
免费在线AI图像放大器,秒将低分辨率照片提升至4K画质
一款支持多模态输入、可单次生成30秒原生4K画质及同步音频的AI视频生成器。
Wan 2.7 AI视频制作器,4K分辨率,30秒片段,原生音频与唇形同步。
veo 4 是一款支持 4K 分辨率、原生音频同步及角色一致性的生成式 AI 视频制作工具。
Alibaba
$1
Input tokens/M
$10
Output tokens/M
256
Context Length
Bytedance
-
$1.8
$5.4
16
Baidu
32
$1.5
$4.5
128
$3
$9
Huawei
Google
$0.14
$0.28
131
$0.35
$0.7
Chatglm
4
Minimax
Tencent
$3.5
$7
Mungert
GLM-4.1V-9B-Thinking是基于GLM-4-9B-0414基础模型开发的视觉语言推理模型,专注于图像文本到文本转换,在复杂多模态任务中表现出色,支持64K长上下文和4K分辨率图像处理,提供中英双语支持。
THUDM
GLM-4.1V-9B-Thinking是基于GLM-4-9B-0414基础模型的开源视觉语言模型,专注于提升复杂任务中的推理能力,支持64k上下文长度和4K图像分辨率。
zai-org
GLM-4.1V-9B-Base是智谱AI开发的开源视觉语言基础模型,拥有90亿参数,专注于多模态推理能力,支持中英双语,处理高达4K分辨率的图像和64K上下文长度。
Efficient-Large-Model
Sana是一个高效生成4K分辨率图像的文本生成图像框架,能够快速合成高分辨率、高质量且文本-图像对齐性强的图像,并可在笔记本电脑GPU上部署。
depth-anything
Prompt Depth Anything 是一种高分辨率且精确的度量深度估计方法,通过提示(prompting)释放深度基础模型的潜力,能够生成高达4K分辨率的精确度量深度。
internlm
InternLM-XComposer2-4KHD是基于InternLM2的通用视觉语言大模型,具备4K分辨率图像理解能力。
Banana Image MCP是一个基于MCP协议的AI图像生成服务器,让Claude等助手能够使用Google Gemini模型生成高质量图像,支持4K分辨率和智能模型选择。