Adobe为旗下实验性iOS相机应用Indigo新增AI功能,通过大语言模型分析照片,提供摄影点评、编辑建议与智能优化。该应用此前已支持专业控制、多帧超分辨率和多种模式,此次添加了照片点评、拍摄与编辑建议、高级物体移除、AI景深生成及风格迁移,强化AI辅助创作。
索尼PS6迎来技术变革,爆料称其将融合视频帧插补、独家超分辨率算法与AI光线追踪,借助AI帧生成等黑科技,目标在4K分辨率下实现120帧超高流畅度体验。
软通动力联合MULEI STUDIO发布“美通 AI”视觉模型,专为B端商业场景设计,旨在解决大屏内容制作成本高、更新难、同质化问题。该模型在分辨率上实现重大突破,满足巨幅显示需求,推动商用视觉内容创作的技术革新。
LG在CES2026前发布全新UltraGear evo系列电竞显示器,全线采用5K超高分辨率,并首次搭载专为游戏的AI像素超分技术,引领电竞显示进入AI时代。系列包含39英寸5K2K OLED、32英寸5K Mini-LED及27英寸5K OLED三款旗舰型号,均支持高刷新率与先进显示技术,兼顾游戏性能与专业创作需求。
HiPixel 是一款用于 AI 驱动的图像超分辨处理的 macOS 桌面客户端应用。
一种无混叠的任意尺度超分辨率方法。
AI驱动的视频音频增强解决方案,提供视频超分辨率、降噪、音频上混等功能。
STAR是一种用于真实世界视频超分辨率的时空增强框架,首次将强大的文本到视频扩散先验集成到真实世界视频超分辨率中。
Anthropic
$105
Input tokens/M
$525
Output tokens/M
200
Context Length
$7
$35
$21
Alibaba
$1
$10
256
Bytedance
-
$0.8
$2
128
Baidu
32
Google
$140
$280
$1.5
$4.5
$3
$9
Openai
$0.7
$2.8
1k
Huawei
$0.14
$0.28
131
$0.35
$1.4
vafipas663
基于Qwen-Image-Edit-2509的图像超分辨率LoRA模型,专门用于提升低质量图像的分辨率和视觉效果。该模型在摄影风格的图像上表现出色,能够处理多种图像退化问题。
lmms-lab
LLaVA-OneVision-1.5 是一系列完全开源的大型多模态模型,通过在原生分辨率图像上进行训练,以较低的成本实现了先进的性能。该模型在多个多模态基准测试中展现出卓越性能,超越了Qwen2.5-VL等竞争对手。
Lightricks
基于扩散模型的视频空间分辨率增强工具,专门针对LTX视频模型生成的潜在视频表示进行超分辨率训练
XiangZ
HiT-SR是一种提升基于变换器的超分辨率方法的通用策略,通过改进现有模型结构,在降低计算负担的同时实现更优的超分辨率性能。
osunlp
Qwen2-VL是Qwen-VL模型系列的最新迭代,具备全分辨率图像理解、超长视频解析和多语言图文识别能力。
3587jjh
一种通过像素级分类实现计算资源自适应分配的高效图像超分辨率方法
Yntec
真实视界 v1.3 是一个基于稳定扩散技术的文本生成图像模型,专注于生成超写实、写实和半写实风格的图像。该模型支持768x768分辨率,强调构图自由和创造力。
NVEagle
鹰(Eagle)是一系列以视觉为中心的高分辨率多模态大语言模型,支持超过1K的输入分辨率,在光学字符识别和文档理解等任务上表现出色。
fal
基于GAN的超分辨率技术,用于提升生成图像的质量
xinsir
基于Stable Diffusion XL的ControlNet Tile模型,专注于图像细节修复、变体生成和超分辨率处理
Ketansomewhere
这是一个无条件生成肺部超声图像的扩散模型,能够生成720x720分辨率的医学影像。
Xenova
基于GAN的4倍超分辨率图像放大模型,兼容Transformers.js
dataautogpt3
TempestV0.1是一款高性能文本生成图像模型,基于超过600万张高质量图像数据集训练,支持超高分辨率图像生成。
轻量级的Swin2SR图像超分辨率模型,可将图像分辨率提升2倍
基于Swin2SR架构的压缩图像超分辨率模型,可将图像分辨率提升4倍
基于Swin2SR架构的经典图像超分辨率模型,可将图像分辨率提升4倍
基于Swin2SR架构的经典图像超分辨率模型,可将图像分辨率提升2倍
LongSafari
HyenaDNA是一个长距离基因组基础模型,在高达100万个标记的上下文长度上以单核苷酸分辨率进行预训练。该模型使用Hyena算子替代传统注意力机制,实现了次二次计算复杂度,能够处理超长DNA序列。
radames
基于扩散模型的文本引导潜在超分辨率工具,可将低分辨率图像提升4倍分辨率
lllyasviel
ControlNet v1.1 是一个通过添加额外条件来控制预训练大型扩散模型的神经网络结构,特别适用于基于瓦片图像条件的图像生成和超分辨率任务。
一个基于Stable Diffusion WebUI API的文本生成图像MCP服务器
这是一个基于Runway API的MCP服务器项目,允许用户通过Claude Desktop调用Runway的各种AI生成功能,包括视频生成、图像生成、视频编辑和超分辨率等工具。