通义千问发布Qwen-Image-3.0 Pro与Standard模型,在Arena文生图榜单位居中国模型第一、主流第二。支持4.5k-token长提示、10px级精细文字渲染及12种语言,Pro版起价0.04美元/张。核心亮点是首次将生成与编辑融合进单一架构,实现多能力统一。
阿里巴巴千问图像生成模型Qwen-Image-3.0上线,旗舰版Pro与标准版API开放,文生图起售价0.18元/张。该模型在Arena.ai文生图榜单居国内第一,主打超长文本理解与精细化渲染,最高支持4.5k token指令,可生成分镜、试卷、九宫格知识图等复杂版面。
Black Forest Labs发布FLUX3多模态基础模型,采用统一架构联合学习图像、视频和音频。基于Self-Flow自监督流匹配框架,在FLUX系列基础上扩展多模态生成与理解。支持文生视频、图生视频,单次生成最长20秒视频并原生输出同步音频,性能全面超越前代。
华为云携手生数科技,上线全球首个“为剧而生”的视频大模型Vidu Q3,主打文生视频与图生视频一体化。该模型专为企业营销、影视及文创设计,核心优势在于强大的叙事能力,可高效生成连贯视频内容,助力创意快速落地。
面向创作者的免设计技能AI图像与视频创意生成平台。
Seedream 5.0 Pro可快速生成高质量AI图,支持多种创作类型。
基于多模型的AI图像与视频生成与编辑平台,支持一键抠图、换背景及艺术字生成。
一站式多模态AI API平台,单个密钥即可调用图像、视频、音乐及文本等前沿大模型。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$6
$24
$2
$20
Baidu
128
hunyuanvideo-community
混元图像2.1是基于diffusers库的文生图模型,能够根据文本描述生成高质量的图像,支持中英双语输入,为用户提供便捷的图像生成体验。
gtmepm
simpletuner-lora 是一个基于 stabilityai/stable-diffusion-3.5-medium 的 LyCORIS 适配器,专门用于文生图等图像生成任务。该模型通过 LoRA 微调技术实现,主要使用验证提示为'A photo-realistic image of a cat'进行训练。
elixirx
charu-anime-lora是一个基于LoRA技术的文生图模型,专门用于生成精美的动漫风格图像,以Qwen/Qwen-Image为基础模型,为动漫图像创作提供高效解决方案。
John6666
基于Stable Diffusion XL技术的文生图模型,专门生成动漫风格女孩图像,为创意设计领域提供支持
Illustrious XL v1.0是基于OnomaAIResearch/Illustrious-xl-early-release-v0训练的文生图模型,专门用于生成多种艺术风格的动漫女性图像,在图像生成领域具有应用价值
lodestones
Chroma1-Base是一个拥有89亿参数的文生图基础模型,基于FLUX.1-schnell架构构建,采用Apache 2.0许可证。该模型专为微调设计,为开发者、研究人员和艺术家提供强大而中立的基础,用于创建专门的生成模型。
基于Stable Diffusion XL架构的文生图模型,专注于生成具有亚洲风格的写实图像,适用于多种创意场景和艺术创作
DFloat11
采用DFloat11无损压缩技术的文生图模型,体积缩减70%的同时保持100%精度
Gen-Verse
MMaDA是一种新型多模态扩散基础模型,在文本推理、多模态理解和文生图等领域表现卓越。
aiyouthalliance
基于Stable Diffusion 1.5构建的免费文生图模型,通过多个LoRA模块微调,生成的图像遵循CC0许可协议,可免费商用无需署名。
quzo
基于FLUX.1-dev的LyCORIS适配器,专注于文生图和图生图任务,支持多种分辨率输出。
guokee
这是一个为FLUX.1-dev文生图模型训练的LoRA适配器,支持通过diffusers或ComfyUI调用,用于生成特定风格的图像。
Eviation
Flex.2-preview 是一个文生图模型,提供多种量化版本,支持 Safetensors 和 GGUF 格式。
Skywork
SkyReels V2是一个无限长度电影生成模型,采用自回归扩散强制架构,支持文生视频和图生视频任务,能够生成高质量的长视频内容。
bghira
Stable Diffusion 3.5 Medium 是一个基于扩散模型的文生图/图生图模型,能够根据文本提示生成高质量的图像。
ShanZard
基于stabilityai/stable-diffusion-3.5-large的LyCORIS适配器,专注于文生图和图生图任务
基于fal/AuraFlow训练的标准PEFT LoRA模型,专注于生成多摩君形象的文生图和图生图任务。
ajiprakoso
这是一个专为FLUX.1-dev文生图模型定制的LoRA适配器,可与diffusers或ComfyUI配合使用。
基于Stable Diffusion和Stable Diffusion XL技术的文生图模型,能够生成逼真、具有良好解剖结构、出色眼睛表现以及优质对比度和阴影效果的图像。
Unmapped2895
基于FLUX.1-dev的PEFT LoRA模型,专注于文生图与图生图任务,特别擅长生成具有高度细节和艺术风格的女性形象。
基于TypeScript的MCP服务器,集成阿里云通义万相的文生图和文生视频API,支持异步任务处理和MCP协议规范
Artifex MCP是一个支持多提供商(Antigravity和OpenAI)的AI图像生成MCP服务器,提供文生图、图生图、多图生成和角色一致性等功能。
基于TypeScript的MCP服务器,集成通义万相的文生图和文生视频API,支持异步任务处理和MCP协议规范。
基于火山引擎Seedream 4.0 API的MCP工具集,提供文生图、图生图、多图融合和组图生成功能,支持七牛云自动上传、提示词模板和图片本地保存。
基于MCP协议的豆包Seedream 4.0文生图服务器,支持AI图片生成、自动下载和本地存储,可集成到Claude Code中使用