人工智能初创公司Ideogram发布4.0开放权重文生图模型,拥有93亿参数,采用单流架构实现文本与图像标志融合,被公认为全球最强开源图像生成AI。
阿里巴巴ATH创新事业部推出新一代多模态视频生成模型HappyHorse,已开启灰度测试。该模型在Arena.ai三大核心榜单(文生视频、图生视频、视频编辑)中表现优异,具备影视级画质与深度语义理解能力,支持1080P超高清输出,能精准驾驭港式风情、古装等多种视觉风格,成为全球AI视频领域的有力竞争者。
美图公司AI Agent产品RoboNeo接入Seedance2.0大模型,实现从“单点生成”到“系统化工作流”的升级。用户可直接调用文生视频、图生视频、首尾帧控制及视频参考生成等能力,支持自由组合创作逻辑,提升AI短视频创作效率与灵活性。
快手旗下可灵AI推出首个“音画同出”模型可灵2.6,能同时生成画面、语音、音效和环境氛围,打通音画世界。该模型提供“文生音画”和“图生音画”两种创作路径,用户可通过一句话或图片快速生成完整视频,提升创作体验。
专为创作者打造的AI视频与图像生成工作室,支持文本、图片生成视频及风格重塑。
腾讯推出的AI驱动智能设计工具,支持文生UI与图片转设计稿,实现高效团队协作。
Paper Banana用AI为研究论文生成科学图表,无需设计技能
专业AI图像生成与编辑平台,支持文生图、图生图,渲染速度快
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
gaianet
Stable Diffusion 3.5 Medium 是由 Stability AI 开发的中等规模文生图扩散模型,支持高质量的图像生成。
shuttleai
一款高效的文生图AI模型,仅需4步即可生成高质量图像,支持多种硬件优化格式。
stabilityai
Stability AI推出的多模态扩散变换器文生图模型,在图像质量、文字排版和复杂提示理解方面有显著提升
IDEA-CCNL
Taiyi-Diffusion-XL是一个专注于增强中文文生图生成能力的同时保留英文理解能力的双语扩散模型。基于Stable-Diffusion-XL架构,通过高质量双语数据集训练,在图像质量、多样性和文本对齐方面表现出色,为AIGC和数字艺术创作提供新的选择。
Artifex MCP是一个支持多提供商(Antigravity和OpenAI)的AI图像生成MCP服务器,提供文生图、图生图、多图生成和角色一致性等功能。
基于MCP协议的豆包Seedream 4.0文生图服务器,支持AI图片生成、自动下载和本地存储,可集成到Claude Code中使用