OpenAI 发布 GPT-5.6 模型家族,包括旗舰 Sol、均衡 Terra 与高性价比 Luna。新一代通过底层技术栈深度优化,大幅提升每 token 智能效率,在降低 API 成本的同时增强性能。其中,旗舰 Sol 开启最大推理能力后,在编码智能体基准测试中表现超越竞品。
Poolside发布完全开源的Laguna S2.1大模型,118B总参数的MoE架构,每token激活8B,支持高达1M tokens上下文,适配长周期软件工程。在OpenCode平台免费开放,并引入thinking与no-thinking推理模式,引起开发者热议。
视觉大模型因隐形门槛——顶尖效果需天量数据与算力,长期仅为头部团队专属。7月21日,小鹏集团发布TuringViT高效视觉编码器,系统性重构架构、数据范式与训练流程,提供可复现、低成本的SOTA级视觉Transformer训练路径,推动先进视觉能力走向行业普惠。
西湖大学联合阿里达摩院推出干细胞AI模型“归元”。它构建了大规模组合扰动数据集,破解干细胞重编程长期依赖经验试错、成本高成功率低的难题。该研究涉及25种调控因子、近400万种潜在组合,模型采用双模态编码策略,能精准预测不同组合对细胞的影响,为高效重编程提供了新路径。
开源编码代理控制平面,可统一编排多模型,受超10万开发者喜爱。
面向AI编码代理的云基础设施平台,提供模型网关、计算等服务
集成聊天、代码、终端等功能的桌面AI编码应用,支持多模型。
Devstral 2开源编码模型及Mistral Vibe CLI,高效解决软件工程任务
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$6
$24
$2
$20
Baidu
128
redis
这是一个基于Alibaba-NLP/gte-reranker-modernbert-base模型,在LangCache句子对数据集上使用sentence-transformers库微调的跨编码器模型。它专门用于计算文本对之间的语义相似度得分,旨在为LangCache语义缓存系统提供高效的文本匹配和重排序能力。
这是一个由Redis微调的交叉编码器模型,专门用于语义缓存场景下的句子对重排序。它基于Alibaba-NLP的gte-reranker-modernbert-base模型,在LangCache句子对数据集上进行训练,能够高效计算两个文本之间的语义相似度得分,用于判断它们是否表达相同或相似的含义。
NewBie-AI
NewBie image Exp0.1 是一个基于 Next-DiT 架构开发的高效图像生成基础模型,专门用于生成高质量的动漫风格图像。它融合了先进的文本编码器和视觉组件,支持自然语言和结构化标签输入,是多角色动漫图像生成的强大工具。
PrimeIntellect
INTELLECT-3是一个拥有1060亿参数的混合专家(MoE)模型,通过大规模强化学习训练而成。在数学、编码和推理基准测试中展现出卓越性能,模型、训练框架和环境均以宽松许可协议开源。
TeichAI
本模型是基于Qwen3-4B-Thinking-2507基础模型,使用高推理难度的Gemini 3 Pro预览数据集进行蒸馏训练得到的模型。它专注于提升在编码和科学领域的复杂推理能力,通过特定数据集的训练,旨在将大型模型(如Gemini 3 Pro)的推理能力高效地迁移到较小规模的模型中。
diffusers
FLUX.2-dev是基于NF4量化的DiT和文本编码器的图像生成与编辑模型,提供高质量的图像生成和编辑能力,适用于图像领域的开发应用。
Kiy-K
Fyodor-Q3-8B-Instruct 是一款专为智能推理和稳健代码生成设计的高保真指令调优模型。它基于Qwen3-8B架构,采用高秩LoRA配置训练,擅长在编码前进行规划,非常适合复杂的软件工程任务。
Clemylia
Qsana-coder-base 是一个小型语言模型(SLM),专门为编码基础(Python、伪代码)的概念创意而设计。它不生成可执行的生产代码,而是为教育和快速原型设计场景生成编码逻辑片段,主要目标是激发初学者的逻辑思维和概念理解。
prithivMLmods
VibeThinker-1.5B是微博AI推出的15亿参数密集语言模型,基于Qwen2.5-Math-1.5B微调,专门针对数学和算法编码问题设计。采用'频谱到信号原理'框架训练,在多个数学竞赛测试中超越规模更大的模型,训练成本约7800美元,支持最长约40k词元的输出。
allenai
Olmo 3是由Allen Institute for AI开发的新一代语言模型家族,包含7B和32B的指令和思维变体。该模型在长链式思维方面表现出色,能显著提升数学和编码等推理任务的性能。所有代码、检查点和训练细节都将公开,推动语言模型科学发展。
Olmo 3是由Allen Institute for AI开发的新一代语言模型系列,包含7B和32B两种规模,有指令和思考两种变体。该模型基于Dolma 3数据集进行预训练,在Dolci数据集上进行后训练,具备长链式思维能力,在数学和编码等推理任务上表现优异。
mlx-community
VibeThinker-1.5B的4位量化版本,基于MLX框架针对苹果芯片优化,是一个拥有15亿参数的密集语言模型,专门用于数学推理和算法编码问题
sbintuitions
Sarashina2.2-Vision-3B是由SB Intuitions训练的日本大型视觉语言模型,基于Sarashina2.2-3B-Instruct和SigLIP图像编码器构建,具备强大的图像到文本转换能力,支持日语和英语的多模态处理。
Olmo 3是由Allen Institute for AI开发的一系列语言模型,包含7B和32B两种规模,具有指令式和思考式两种变体。该模型在长链式思维方面表现出色,能有效提升数学和编码等推理任务的性能。采用多阶段训练方式,包括有监督微调、直接偏好优化和可验证奖励的强化学习。
Olmo-3-7B-Think-DPO是Allen Institute for AI开发的7B参数语言模型,具有长链式思考能力,在数学和编码等推理任务中表现出色。该模型经过监督微调、直接偏好优化和基于可验证奖励的强化学习等多阶段训练,专为研究和教育用途设计。
Olmo 3是由Allen Institute for AI (Ai2)开发的一系列语言模型,包含7B和32B两种规格,有Instruct和Think两种变体。该模型基于Transformer架构,具有长链思维能力,可有效提升数学和编码等推理任务的表现。
Olmo 3是由Allen Institute for AI开发的开源语言模型系列,包含7B和32B两种规格,分为指令(Instruct)和思考(Think)两种变体。该模型具有出色的长链思维能力,能够显著提升数学和编码等推理任务的表现。
Olmo 3是由Allen Institute for AI开发的全新语言模型家族,包含7B和32B两种规模,有指令(Instruct)和思维(Think)两种变体。该模型采用长链式思维提升数学和编码等推理任务表现,旨在推动语言模型科学发展。
Olmo 3 7B RL-Zero Mix是Allen AI开发的7B参数规模的语言模型,属于Olmo 3系列。该模型在Dolma 3数据集上进行预训练,在Dolci数据集上进行后训练,并通过强化学习优化数学、编码和推理能力。
这是一个基于Claude Sonnet 4.5推理数据集训练的30B参数大语言模型,专门针对高难度推理任务进行优化,在编码和科学领域表现出色。
Zen MCP是一个多模型AI协作开发服务器,为Claude和Gemini CLI等AI编码助手提供增强的工作流工具和跨模型上下文管理。它支持多种AI模型的无缝协作,实现代码审查、调试、重构等开发任务,并能保持对话上下文在不同工作流间的延续。
Mapbox MCP服务器是一个Node.js实现的模型上下文协议服务器,为AI应用提供Mapbox地理空间API的访问能力,包括地理编码、兴趣点搜索、路线规划、等时线分析和静态地图生成等功能。
CLEO是一个为AI软件开发设计的便携式大脑与记忆系统,提供跨仓库、模型供应商和编码工具的项目记忆、可验证来源和代理安全编排。
Aider MCP Server是一个实验性模型上下文协议服务器,用于将AI编码任务卸载到Aider,提高开发效率和灵活性。
Notebook Intelligence (NBI) 是一个为JupyterLab设计的AI编码助手和可扩展AI框架,支持GitHub Copilot及其他LLM提供商的模型,包括本地Ollama模型。它通过代码生成、自动补全和聊天界面等功能显著提升生产力,并支持Model Context Protocol (MCP) 服务集成。
腾讯云COS MCP Server是一个基于MCP协议的服务,无需编码即可让大模型快速接入腾讯云存储(COS)和数据万象(CI)能力,提供文件上传下载、图片处理、视频截帧等云端存储与处理功能。
Webvizio MCP服务器是一个基于TypeScript的模型上下文协议服务器,提供对Webvizio API的安全结构化访问,可将网站反馈和错误报告自动转换为可执行的开发任务,供AI编码代理处理。
MCPollinations是一个基于Model Context Protocol(MCP)的多模态AI服务,支持通过Pollinations API生成图像、文本和音频。它提供无需认证的轻量级服务,兼容多种AI模型,并支持图像保存和Base64编码返回。
智能代码语义搜索MCP服务器,通过本地AI模型为编码助手提供基于语义的代码搜索功能,支持多项目管理和渐进式索引。
Snowfort Circuit MCP是一个全面的模型上下文协议服务器套件,为AI编码代理提供网页和Electron桌面应用自动化能力,具有AI优化的快照、智能截图压缩和多会话管理等功能。
FFmpeg-MCP是一个模型上下文协议服务器,旨在帮助LLM处理各种人类和机器创建的多媒体内容,包括解码、编码、转码、混合、分离、流传输、过滤和播放等功能。
TOON MCP服务器是一个用于TOON编码的模型上下文协议服务器,通过紧凑的数据格式将结构化数据转换为令牌优化的表示,可减少50-70%的LLM令牌使用量,从而显著降低AI调用成本。
Whimsical MCP Server是一个基于模型上下文协议(MCP)的服务,允许通过编程方式创建Whimsical图表。该服务与Whimsical API集成,可将Mermaid标记转换为图表,并返回图表URL和base64编码图像。
这是一个基于TypeScript的模型上下文协议(MCP)服务器,提供访问Stadia Maps API的能力,包括地理位置服务、地理编码、路线规划和地图生成等功能。
一个基于dbt CLI的模型上下文协议(MCP)服务器,为AI编码代理提供标准化接口来操作dbt项目,支持所有主要dbt命令执行。
腾讯云COS MCP Server是一个无需编码即可让大模型快速接入腾讯云存储(COS)和数据万象(CI)能力的服务,提供文件上传下载、图片处理、视频处理等云端存储与处理功能。
一个MCP服务器,用于从rival.tips查询AI模型比较数据,包括基准测试、价格和功能,供Claude、Cursor等AI编码助手使用。
CCXT MCP服务器通过标准化的模型上下文协议,为AI交易策略提供与100多家加密货币交易所的无缝对接,实现无需编码的自动化交易。
BluestoneApps MCP远程服务器实现了基于HTTP的模型上下文协议(MCP),提供编码标准和代码示例的远程访问服务,支持JSON-RPC 2.0和SSE流式响应。
一个基于MCP协议的AI软件架构师服务器,能够分析代码库生成产品需求文档(PRD)并为复杂编码任务提供推理辅助,采用多模型架构和智能代理设计。