阿里巴巴千问图像生成模型Qwen-Image-3.0上线,旗舰版Pro与标准版API开放,文生图起售价0.18元/张。该模型在Arena.ai文生图榜单居国内第一,主打超长文本理解与精细化渲染,最高支持4.5k token指令,可生成分镜、试卷、九宫格知识图等复杂版面。
阿里发布Qwen-Image-3.0图像生成基础模型,支持最长4.5K Token文本输入,可一次性生成公式、几何图形、逻辑推导及多层UI等复杂内容,原生兼容12种语言和20余款字体渲染,文本长度较上代提升4.5倍,大幅强化影视分镜、知识图解等商业级图文创作能力。
微软在GitHub开源了专为iOS设计的SwiftStreamingMarkdown渲染库,旨在解决大模型应用在聊天界面中Markdown文本流式渲染的性能瓶颈。该库为移动端开发者提供高效方案,应对AI对话时逐字生成文本的流畅展示与阅读体验挑战,弥补传统解析器在处理文本流时的不足。
智象未来在首届开放日上发布基于“Unified Transformer(UiT)”架构的图像大模型HiDream-O1-Image-Pro,参数超两千亿,实现像素、文本与任务条件统一,在文生图、文字渲染和图像编辑等任务上达到行业顶尖水平。
一个专注于文本渲染、电商出图和UI探索的高性能AI图像与视频生成工作区。
新一代AI图像生成器,支持精准文本渲染、写实画质及对话式图像编辑。
OpenAI推出的全能型AI图像生成器,具备超高文本准确率与像素级UI设计能力。
免费在线AI图像生成器,文本渲染近乎完美,照片级画质,无需订阅。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
Baidu
128
$6
$24
256
Bytedance
$1.2
$3.6
4
$2
$3.9
$15.2
64
PeterKocsis
IntrinsiX是一个专注于利用图像先验进行高质量PBR(基于物理的渲染)生成的项目,能够从文本输入生成可渲染的PBR地图,为图像生成和大规模PBR纹理生成提供创新解决方案。
Qwen
Qwen-Image是通义系列的多模态图像生成基础模型,在复杂文本渲染和精确图像编辑方面表现卓越,特别擅长中文文本渲染,支持多种图像生成和编辑任务。
PosterCraft
PosterCraft是一个用于高质量美学海报生成的统一框架,在精确文本渲染、抽象艺术无缝融合、醒目布局和风格协调方面表现出色。
X-ART
LeX-Lumina是一个高质量的文本生成图像模型,专注于提升文本渲染保真度和美学效果。
Yntec
复仇者是基于LiberteRedmond与Vintedois混合模型并融合3D渲染LoRA的文本生成图像模型,优化了构图能力与简洁提示词效果。
goofyai
基于FLUX框架开发的3D渲染文本生成图像模型,支持通过LoRA微调生成高质量3D风格图像
gvecchio
StableMaterials 是一款基于扩散模型的物理渲染(PBR)材质生成工具,能够根据文本或图像提示生成高分辨率、可平铺的材质贴图。
JingyeChen22
TextDiffuser-2 是一个文本生成图像的模型,专注于文本渲染任务,通过释放语言模型的潜力来生成包含文本的图像。
基于Stable Diffusion XL的3D风格图像生成模型,支持通过文本提示生成高质量的3D渲染风格图像。
digiplay
一个高质量的稳定扩散模型,能够根据文本描述生成逼真的图像,尤其擅长人物肖像和复杂细节的渲染。
openai
Shap-E是一种基于扩散过程的文本生成3D图像模型,能够根据文本提示生成可渲染为纹理网格和神经辐射场的3D资产。
yuanzheng
这是一个基于Dreambooth技术微调的文本生成图像模型,专注于商业场景的图像生成,特别是日本料理和清酒的高质量渲染。
Scrapi AI的MCP服务器可将网页URL转换为干净的Markdown/文本格式,供AI代理读取和分析网页内容,支持JavaScript渲染和批量处理。
这是一个用于生成PDF文档的MCP服务器,支持从文本、布局创建PDF,以及将PDF页面渲染为图像,特别适用于简历生成和灵活排版。
D2 MCP Server是一个提供D2图表生成和操作功能的模型上下文协议服务器,支持通过文本创建、渲染、导出和保存D2图表,并具备增量编辑能力。
一个用于获取和转换网页内容的MCP服务器,支持多种格式提取和渲染,包括原始文本、HTML、Markdown以及媒体文件内容分析。