谷歌推出新功能,用户生成图片、视频、音乐时可自主选择关闭显式水印。该功能由Gemini负责人乔希·伍德沃德透露,将陆续上线Nano Banana、Omni、Lyria等模型,并优先在Gemini网页端及谷歌视频产品中开放。
微信朋友圈正灰度上线“AI帮写”功能,用户发图文或纯文字时,可唤出AI助手“小微”自动生成文案。该功能支持语音与文字交互,能识别图片内容,按用户指令提供简洁、调侃、文艺三种风格候选,大幅降低创作门槛,选定即可使用。
千万粉科技博主“影视飓风”推出49元AI实战课,首日售出超10万份,销售额破490万,凸显头部IP在AI教育领域的变现能力。课程原价99元,含16节五大单元,涵盖AI图片与视频生成、提示词编写等基础,以及机械臂运镜、子弹时间、AI分镜等影视特效实战。
蚂蚁集团灵光App旗下社区“灵光圈”近日升级,新增热榜、精选及关注功能,PC端支持文档、图片等多模态文件上传,用户可基于本地内容生成智能问答或AI应用,显著提升应用发现效率与创作体验。
免费在线AI视频与图像生成平台,10+工具,专业品质,全商业权
全能型AI图像生成与编辑工具,支持文本绘图、多图融合及最高4K高清输出。
AI视频生成器,可从文本、图片生成视频、图像和音频,有免费额度。
单MCP服务器集成图像生成、编辑、去背景、4K 放大等功能,供AI 代理使用。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
starsfriday
这是一个基于 Qwen/Qwen-Image 训练的人像生成模型,专门用于生成中国古风风格的动漫图片。该模型通过 LoRA 技术微调,能够生成具有传统东方美学特征的数字艺术作品。
ByteDance
InfiniteYou(InfU)是一个基于FLUX扩散变换器(DiT)的身份保持图像生成框架,能够在保持身份特征的同时实现灵活的图片重塑。
Keltezaa
基于FLUX.1-dev基础模型定制的LoRA模型,专注于生成高质量的女性形象图片,特别是名人风格的肖像。
DeZoomer
基于AI-Toolkit (Flux.1开发版)训练的文本生成图像模型,使用20张公开图片进行本地训练,专注于角色特征还原。
punzel
基于25张比莉·艾利什图片训练的LoRA模型,无需触发词即可生成比莉·艾利什风格的图像
基于25张麦迪逊·比尔图片训练的LoRA模型,无需触发词即可生成相关风格图像
yayayaaa
基于Florence-2-large-ft模型在imageinwords数据集上微调,专注于生成更详细的图片描述
nnpy
这是一个基于 BLIP 架构的图像描述生成模型,能够为输入的图片生成简洁的文字描述。
DeepFloyd
DeepFloyd-IF是一款基于像素的文本到图像三级级联扩散模型,能够生成具有新突破的写实风格与语言理解能力的图片。
Guizmus
一个基于Stable Diffusion 1.5的文本生成图像模型,专为Discord上的'每周图片'比赛设计,旨在通过艺术表达情感和故事。
faalbane
这是一个基于Stable Diffusion v1.5微调的Dreambooth模型,使用21张训练图片训练而成,用于生成特定风格的图像。
joyc360
基于HuggingPics生成的图像分类模型,用于区分深度伪造图片和真实图片
tuman
这是一个基于COCO2014数据集翻译版(英俄)训练的图片描述生成模型,能够为输入的图像生成俄语描述。
JosephusCheung
专为二次元爱好者打造的潜在扩散模型,能通过简单提示生成高质量、高细节的动漫风格图片
3ee
基于F222微调的稳定扩散模型,专注于生成装饰风格的圣诞老人图像,包含200多张训练图片。
基于马赛克艺术图片训练的Dreamboothed稳定扩散模型,可生成马赛克艺术风格的图像。
ringhyacinth
这是一个基于美甲套装图片微调的Stable Diffusion模型,可用于生成各种风格的美甲设计。
osanseviero
一个基于HuggingPics生成的图像分类模型,能够准确区分羊驼和土豆的图片。
一个基于MCP服务器的PowerPoint演示文稿生成项目,支持创建、编辑和保存演示文稿,包含多种幻灯片类型和图表生成功能。
一个提供多种占位图片生成服务的MCP服务器
该项目是一个基于MCP协议和python-pptx库的PPT制作服务,支持通过聊天交互动态创建、编辑和保存PowerPoint演示文稿,提供添加幻灯片、图片、表格等多种功能,并能生成下载链接和导出为Base64格式。
基于MCP协议的Flux Schnell图片生成服务器,通过Replicate API实现AI绘图功能
Placid.app MCP服务器是一个用于与Placid.app API集成的服务实现,提供模板管理和多媒体生成功能。
基于火山引擎SeeDream模型的MCP图片生成工具,支持高质量图片生成、自定义尺寸和智能参考图,可通过MCP协议在Cursor、Claude Desktop等客户端中使用。
ComfyUI-AnimaTool是一个让AI Agent直接生成二次元图片并原生显示在聊天窗口的工具,通过MCP协议或HTTP API连接ComfyUI,支持结构化提示词、多长宽比、批量生成和LoRA加载等功能。
Ideogram MCP Server是一个基于Ideogram API的图片生成服务,提供多种可定制的图片生成参数,包括比例、模型、风格等。
自动生成完整网站图标集的MCP服务,支持从PNG图片或URL创建多种尺寸的favicon、苹果触摸图标及网页应用清单文件。
一个基于MCP平台的本地代理服务器和客户端实现,集成天气查询、谷歌搜索、摄像头控制、图片生成和智能对话等多种AI工具功能,支持模块化扩展和高性能并发处理。
基于火山引擎即梦AI的图片生成MCP服务,提供标准化接口生成高质量图片,支持多种比例和自定义参数。
一个基于MCP服务器的PowerPoint演示文稿生成项目,支持通过API调用Stable Diffusion生成图片,并提供多种幻灯片模板和编辑功能。
Word MCP Server是一个基于Python的API服务,用于通过FastMCP框架创建和编辑Word文档,支持文本格式化、图片插入和表格生成等功能。
基于Together AI的图像生成服务,集成Cursor MCP,支持多种宽高比和批量生成的高质量图片生成工具。
基于MCP协议的小红书图文内容生成工具,提供智能大纲生成、图片生成和项目管理功能
一个通过Replicate的FLUX模型生成图片并存储到Cloudflare R2的MCP服务器
基于GLM-4.5V模型的MCP服务器,提供智能图片分析功能,支持从文件路径或剪贴板获取图片,专门用于代码内容提取、架构分析、错误检测和文档生成。
基于Ideogram API的图片生成MCP服务器
一个基于多API的图片搜索与图标生成服务,专为Cursor IDE设计,提供图片搜索、下载及AI生成图标功能
一个基于MCP协议的图像处理服务器,通过自然语言指令实现专业级图片编辑功能,包括生成、修改、背景移除和托管服务。