阿里发布全新Qoder,将AI编程IDE升级为以Coding能力为核心底座的智能体工作台。用户用自然语言描述目标,即可由其理解上下文、制定计划、调用工具、执行并验证,全程可查看、调整或接管。该IDE全球发布一年累计用户超600万,服务超10万家企业。新版本背后是三重协作范式转移。
8月17日,阿里发布AI音乐生成模型HappyShrimp(快乐虾米)1.0。它突破传统标签式输入门槛,用生活化自然语言即可驱动作词、作曲、编曲、演唱全流程,让普通用户产出高完成度原创音乐。不同于堆砌专业术语的工具,它将音乐理解为有语法、语义的创作。
美图发布AI影像生产线平台MeituHub,为企业提供从需求理解、流程搭建到成品交付的全链路方案。该平台整合全栈影像技术,企业无需开发,仅凭自然语言即可创建专属视觉工作流,并生成可复用Web应用。此举旨在解决生成式AI工具割裂的痛点,构建稳定高效的影像生产流程。
商汤开源轻量级多模态模型SenseNova U1.5-Lite-Preview,采用8B-MoT参数和NEO-unify架构,支持原生4K图像生成、精细纹理、精准中英文字生成及稳定图像编辑。该模型重点提升长篇自然语言与结构化视觉指令理解,实现复杂需求下的精准多模态生成。
Nana Banana AI:先进图像生成与编辑器,用文本指令轻松编辑图像。
AI辅助的视觉UI开发工具,通过精确的DOM信息和自然语言描述帮助AI准确理解您的UI修改意图。
谷歌高质量文本到图像模型,生成逼真、生活化图像。
点燃语言智能,从思维链到语言代理
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
Anthropic
$105
$525
200
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
-
$8
$240
52
Bytedance
$1.2
$3.6
4
intexcp
ru-en-RoSBERTa是一个在多语言任务中表现出色的模型,基于RoBERTa架构,专门针对俄语和英语任务进行优化。该模型在多种自然语言处理任务上进行了全面测试,包括分类、聚类、重排序和检索等,展现了强大的跨语言理解能力。
inclusionAI
铭音通是一个创新的统一语音框架,将语音理解、生成和编辑功能整合为一体。它采用统一的连续语音分词器,能在端到端模型中有效融合语义和声学特征,是首个仅通过自然语言指令就能实现通用、自由形式语音编辑的系统。
TIGER-Lab
Qwen2.5-VL-7B-Instruct是阿里巴巴通义千问团队开发的多模态视觉语言模型,基于70亿参数规模,专门针对视觉问答任务进行优化训练。该模型能够理解和分析图像内容,并生成准确的自然语言回答。
cpatonn
Qwen3-30B-A3B-Thinking-2507-AWQ是基于Qwen3-30B-A3B-Thinking-2507模型进行AWQ量化处理后的版本。该模型在推理能力、通用能力和长上下文理解能力等方面有显著提升,支持256K上下文长度,可应用于多种自然语言处理任务。
mlx-community
这是一个基于Qwen3架构的大语言模型,经过3位数量化处理,专门针对指令跟随任务进行了优化。该模型具有2350亿参数规模,支持多语言处理能力,适用于各种自然语言理解和生成任务。
mradermacher
这是 prithivMLmods/WR30a-Deep-7B-0711 模型的静态量化版本,支持多种自然语言处理和视觉理解任务。
unsloth
Cosmos-Reason1是NVIDIA开发的物理AI模型,能够理解物理常识并通过长链思维推理生成具身决策自然语言。
clouditera
全球首个网络安全开源大模型,专为网络安全场景打造,融合自然语言理解、代码生成、安全知识推理等核心能力。
InstaDeepAI
ChatNT是首个深度理解生物序列(DNA、RNA、蛋白质)的多模态对话智能体,支持自然语言交互处理生物数据。
S-Dreamer
PyCodeT5是CodeT5模型的专用变体,专门针对生成和理解Python函数进行了微调,能够将自然语言描述转换为功能性Python代码。
VPLabs
专为电商搜索优化的对话式嵌入模型,基于Stella Embed 400M v5微调,擅长理解自然语言查询并匹配相关商品
yeniguno
这是一个基于BERT的微调模型,用于将用户输入分类为82种不同的意图,适用于对话系统和自然语言理解任务。
SEOKDONG
基于LlaMA3.2 1B模型通过SFT方式微调的韩语语言模型,使用53个领域的韩语数据进行训练,能够理解韩国社会价值和文化,支持文本生成、问答等多种自然语言处理任务。
Keltezaa
基于Flux dev 1.0的脸型LoRA模型,专注于生成真实感亚洲女性形象,支持自然语言提示词理解。
Infermatic
inferor 0.1是基于Mistral-Nemo架构的合并语言模型,采用Model Stock合并方法将多个预训练模型融合而成的新版本。该模型在文本生成和理解任务上表现出色,支持多种自然语言处理应用。
banglagov
这是一个专门针对孟加拉语预训练的BERT基础模型,基于Transformer架构,具有1.1亿参数。模型通过36GB孟加拉语文本数据训练,能够有效理解孟加拉语的上下文语义,支持多种自然语言处理任务。
AIDX-ktds
ktdsbaseLM v0.11 是基于 OpenChat 3.5 的韩语大语言模型,专注于理解韩语及韩国多元文化,适用于多种自然语言处理任务。
MaziyarPanahi
基于Qwen/Qwen2.5-72B-Instruct微调的高级语言模型,在自然语言理解和生成方面表现优异
Jacaranda
YorubaLlama是基于Meta-Llama-3-8B开发的专门针对约鲁巴语优化的语言模型,提升了约鲁巴语的自然语言理解和生成能力,适用于问答、聊天等多种下游任务。
Trendyol
由Trendyol预训练的土耳其语Bert模型,适用于多种自然语言理解任务。
QueryWeaver是一个开源的Text2SQL工具,通过图驱动的模式理解将自然语言问题转换为SQL查询,支持REST API和MCP协议。
一个基于MCP协议的代码分析服务器,通过自然语言对话帮助AI模型理解和分析代码库,提供轻量级的代码探索与理解功能。
基于人工智能的号卡查询工具,通过自然语言理解用户需求,自动查询172号卡平台数据并智能推荐最符合需求的套餐,显著减少用户选择时间。
DINO-X MCP是一个通过DINO-X和Grounding DINO 1.6 API赋能大型语言模型进行细粒度目标检测和图像理解的项目。它能够实现精确的对象定位、计数、属性分析以及场景理解,支持自然语言驱动的视觉任务和工作流集成。
这是一个基于MCP协议的《古兰经》搜索引擎服务器,旨在为AI助手提供准确、无幻觉的《古兰经》经文查询服务。它利用专门的搜索引擎处理阿拉伯语标准化、词根和词元匹配,确保返回的经文文本绝对准确,而AI仅负责理解用户的自然语言查询意图。
Gemini Cloud Assist MCP服务器是一个连接MCP客户端与Google Cloud Gemini Cloud Assist API的工具,允许用户使用自然语言理解、管理和排查Google Cloud环境问题。
MCP-Memos是一款基于MCP协议的备忘录工具,专为开发者设计,支持快速记录和检索文本信息,无需切换应用。它利用大型语言模型提供强大的模糊搜索能力,包括语义理解、上下文感知和自然语言查询等功能。
DINO-X MCP是一个结合大型语言模型与DINO-X、Grounding DINO 1.6 API的项目,旨在实现细粒度物体检测和图像理解,支持自然语言驱动的视觉任务和自动化场景。
该项目展示了一个基于AWS Bedrock的AI驱动自动化系统,能够理解自然语言支持请求,并通过独立的MCP服务器自动执行功能管理操作,具备企业级安全性和完整的测试覆盖。
这是一个基于Model Context Protocol (MCP)标准的PostgreSQL语义搜索服务器,通过向量嵌入技术使AI助手能够理解数据库语义结构并执行自然语言查询。