Adobe正式宣布收购专注图像视频增强AI二十余年的Topaz Labs,将其并入创意业务。此举意在强化专业影像修复与端侧优化。Topaz曾获艾美奖,近期推出视频放大模型“Astra”与图像修饰模型“Wonder”,并在消费级GPU高效运行上取得进展。
iOS 27 中 Apple 推出独立 Siri AI App,采用聊天机器人界面,支持文本、图像、文件输入及历史记录。核心亮点是可在 Siri AI 与 ChatGPT 间一键切换,无需深入系统设置;默认使用 Apple 自家增强版模型,兼顾无缝集成与用户选择。
据分析师郭明錤透露,OpenAI 首款手机计划于2027年初量产,搭载定制版联发科天玑9600处理器,配备增强型HDR图像信号处理器,旨在提升智能体验和视觉效果。
通义实验室推出Wan2.7-Video视频创作工具,旨在解决AI视频创作中内容不专业和修改困难两大痛点。该工具支持文本、图像、视频和音频全模态输入,提供先进的模型以提升画面结构、剧情走向等内容的生成质量,增强创作自由度与编辑灵活性。
AI图片编辑器,可去除背景、擦除物体、提升画质并生成新场景
OmniEnhancer利用AI提升图像质量,免费上传、优化并下载,无需注册。
在线AI图像与视频生成器,秒速生成4K高质量内容,多格式支持
一体化AI图像生成、编辑与增强工具,30+工具一站式使用。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
Anthropic
$105
$525
200
$0.7
$7
$35
$17.5
$21
Alibaba
-
$4
$16
$1
$10
256
$2
$20
$8
$240
52
Bytedance
$1.2
$3.6
4
DavidAU
这是一个增强版的多模态视觉语言模型,基于Qwen3-VL-8B-Thinking模型,通过Brainstorm 20x技术扩展至12B参数,采用NEO Imatrix增强的GGUF量化。模型具备强大的图像理解、文本生成和多模态推理能力,在视觉感知、文本质量和创意场景方面都有显著提升。
peteromallet
QwenEdit InScene LoRAs是基于QwenEdit微调的模型组,专注于增强基于场景参考生成图像的能力。包含InScene主模型和InScene Annotate两个组件,能够在保持角色一致性和场景连贯性的同时创建全新的场景镜头。
spamnco
这是一个基于Wan2.1-T2V-14B模型训练的LoRA适配器,专门用于文本到视频转换任务,为图像生成提供增强功能。该模型使用AI Toolkit训练,需要特定的触发词'diddly'来激活图像生成。
flymy-ai
这是一个由FlyMy.AI开发的开源LoRA模型,专为Qwen-Image-Edit设计,专注于场景内图像编辑,通过低秩自适应技术增强对场景构图和对象定位的控制能力。
mradermacher
PromptEnhancer-32B 是一个支持多语言的32B参数大语言模型,专门用于文本到图像、提示增强、提示重写和思维链等任务。该版本提供了多种量化类型的GGUF格式文件,便于在不同硬件环境下部署使用。
AntResearchNLP
ViLaSR-7B是基于Qwen2.5-VL-7B-Instruct构建的视觉语言模型,专门用于增强空间推理能力。通过交织思维和视觉绘图的方法,该模型在图像文本到文本转换任务中表现出色,能够更好地理解和处理空间关系信息。
inclusionAI
ViLaSR-7B是一个基于Qwen2.5-VL-7B-Instruct构建的视觉语言模型,专门针对多模态场景下的图像与文本交互及空间推理问题进行了优化,通过交织思考和视觉绘图的方法增强空间推理能力。
WenchuanZhang
Patho-R1-7B是一款专门针对病理学领域设计的多模态推理模型,通过三阶段训练管道(持续预训练、监督微调、强化学习)来增强病理诊断理解能力,能够有效处理高分辨率病理图像和复杂诊断推理任务。
ggml-org
这是一个基于Mistral-Small-3.1-24B-Instruct-2503的视觉增强版本,支持图像文本生成文本任务。
Fediory
HVI-CIDNet是一种用于低光照图像增强的深度学习模型,基于新的色彩空间HVI设计。
HVI-CIDNet 是一种用于低光照图像增强的深度学习模型,基于新的色彩空间HVI设计。
HVI-CIDNet是一种用于低光照图像增强的深度学习模型,基于新型色彩空间HVI设计。
HVI-CIDNet是一种用于低光照图像增强的深度学习模型,基于新的HVI色彩空间设计。
HVI-CIDNet是一种用于低光照图像增强的深度学习模型,基于新型色彩空间HVI设计
HVI-CIDNet是一种用于低光照图像增强的模型,基于新的色彩空间HVI设计。
HVI-CIDNet 是一种用于低光照图像增强的模型,基于新型色彩空间 HVI 设计,旨在提升低光照条件下的图像质量。
X-ART
LeX-Enhancer 是一个轻量级的提示增强模型,基于 DeepSeek-R1 蒸馏而来,用于生成高质量、视觉丰富的提示输出,适合文本到图像生成。
HVI-CIDNet 是一种用于低光照图像增强的深度学习模型,基于新的色彩空间 HVI 设计。
AWS MCP Servers是一套基于Model Context Protocol的专用服务器,提供多种AWS相关功能,包括文档检索、知识库查询、CDK最佳实践、成本分析、图像生成等,旨在通过标准化协议增强AI应用与AWS服务的集成。
MiniMax为Coding Plan用户定制的MCP服务器,提供AI驱动的网络搜索和图像分析工具,专为代码开发工作流优化,可集成到Claude Desktop、Cursor等MCP客户端中增强编程体验。
Luma AI的MCP服务器,通过Dream Machine API实现文本/图像生成视频、视频增强及创意内容管理功能