xAI发布Grok 4.6,AI智能指数61分,追平GPT-5.6 Sol(Max),仅次于Claude Opus 5与Claude Fable 5,跻身全球前沿模型第一梯队。该模型在Grok 4.5基础上扩展训练,核心改进包括用模型生成的精选数据训练推理与高级技术概念,并结合高质量工程数据和改进的优化器。
谷歌Gemma4系列模型全球下载量突破3亿大关,这一里程碑在Google I/O上海期间对外公布。该模型于今年4月发布,专为高级推理和智能体工作流精心设计,推出后迅速获全球开发者高度关注与广泛应用,交出了亮眼成绩单。
在Build2026大会上,微软发布首款高级推理模型MAI-Thinking-1,拥有350亿参数,在软件工程基准测试中达领先水平。该模型基于干净数据从零训练,未使用外部来源数据,标志着微软在自研AI及全场景矩阵构建上迈出关键一步。
信通院发布“方升”AI评测体系3.0,新增模型基础属性测试,系统评估参数规模与推理效率,并前瞻布局全模态理解、长期记忆等十项高级智能测试,推动国内AI评测发展。
Google DeepMind旗舰多模态AI,1M上下文,具备博士级推理与高级编码能力
InternLM3-8B-Instruct是一个开源的80亿参数指令模型,用于通用用途和高级推理。
医疗领域大型语言模型,用于高级医疗推理
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$7
$35
Google
$2.1
$17.5
$21
$105
$0.7
Alibaba
$4
$16
$1
$10
256
$6
$24
$2
$20
Baidu
128
Moonshot
Bytedance
$0.8
32
zai-org
GLM-4.6-FP8是智谱AI推出的新一代文本生成模型,相比GLM-4.5在多个关键方面有显著改进。该模型具有更长的上下文窗口、卓越的编码性能、高级推理能力和更强大的智能体功能,能够处理更复杂的任务。
geoffmunn
这是阿里巴巴Qwen系列80亿参数大语言模型的GGUF量化版本,专为高级推理、智能体行为和多语言任务设计,可与llama.cpp及兼容工具配合使用。
NetoAISolutions
TSLAM-15B是由NetoAI Solutions开发的150亿参数电信专用语言模型,基于混合专家架构,针对电信领域专业知识、高级推理和面向行动的工作流程进行了优化。
LGAI-EXAONE
EXAONE 4.0 模型集成了非推理模式和推理模式,兼具 EXAONE 3.5 的出色可用性与 EXAONE Deep 的高级推理能力。支持英、韩、西三种语言,为智能应用提供更强大的支持。
HuggingFaceTB
SmolLM3是一款参数为30亿的语言模型,旨在突破小模型的性能边界。它支持6种语言,具备高级推理能力和长上下文处理能力,是一个完全开源的模型。
spiral-rl
Spiral-Qwen3-4B是基于自博弈强化学习框架SPIRAL在多游戏场景下对Qwen3基础模型进行训练得到的模型,在双人零和文本游戏中展现高级推理策略,并在数学和通用推理基准测试中表现优异。
Mungert
Phi-4-mini-reasoning 是一个基于合成数据构建的轻量级开放模型,专注于高质量、富含推理的数据,并针对更高级的数学推理能力进行了进一步微调。
unsloth
Phi-4-reasoning-plus是微软基于Phi-4微调的最先进开放权重推理模型,专注于数学、科学和编码领域的高级推理能力。
Phi-4推理增强版是微软研究院开发的140亿参数开源推理模型,通过监督微调和强化学习优化,专注于数学、科学和编程领域的高级推理能力。
Phi-4-reasoning-plus 是由微软研究院开发的开源推理模型,专注于数学、科学和编程领域的高级推理能力。
microsoft
Phi-4-mini-reasoning是一个轻量级的开源模型,专注于高质量、密集推理的数据,并进一步微调以获得更高级的数学推理能力。
cortexso
Qwen3是由Qwen团队开发的一系列先进语言模型,在高级推理、对话、指令遵循和智能体应用等方面表现卓越。
gerasmark
本模型是基于Mistral-7B-Instruct-v0.3优化的微调版本,专为法医调查领域的问答任务设计,支持高级法医调查推理和快速知识检索。
GusPuffy
Synthia-S1-27b是由Tesslate AI开发的高级推理AI模型,专注于逻辑推理、编码和角色扮演任务。
Phi-4-reasoning-plus 是微软研究院开发的先进开放权重推理模型,基于 Phi-4 通过监督微调和强化学习优化,专注于数学、科学和编码领域的高级推理能力。
vicharai
Dhruv-27B-preview是基于Gemma3的270亿参数语言模型,专为高级推理任务微调,适用于学术、逻辑和事实评估。
HyperX-Sen
基于Qwen/Qwen2.5-7B-Instruct微调的版本,专门针对高级推理任务进行了优化
Vikhrmodels
该模型是基于Qwen/Qwen2.5-7B-Instruct的实验性监督微调版本,专为工具规划任务设计,具备高级推理和工具调用能力。
matatonic
Mistral Small 3 (2501) 是一款拥有240亿参数的大语言模型,在70B以下的小型模型类别中表现优异,支持多语言和高级推理能力。
hongzhouyu
FineMedLM-o1是一款专为高级医学推理设计的专业医疗大语言模型,采用多步推理机制,在给出最终答复前会反复推敲并完善其思考过程。
GemForge是将Google的Gemini AI与MCP生态系统连接的企业级工具,提供实时网络访问、高级推理、代码分析和多文件处理等功能,支持60多种文件格式,具备智能模型选择和强大的错误处理机制。
一个为Cursor AI中的Claude提供高级推理能力的MCP服务器,包含多种推理方法如蒙特卡洛树搜索、束搜索和Transformer混合推理等。
该项目是一个基于Model Context Protocol (MCP)的stdio服务器,用于将提示转发至OpenAI的ChatGPT (GPT-4o),支持高级摘要、分析和推理功能,适用于LangGraph框架的助手集成。
MCP Thought Server是一个为AI代理提供高级思维工具的服务,通过模型上下文协议(MCP)增强推理、规划和迭代优化能力。它包含结构化思维、迭代草稿和集成思维等工具,支持SQLite持久化和高级置信度评分系统,可配置环境变量以适应不同需求。
GemForge是将谷歌Gemini AI与MCP生态系统连接的企业级工具,提供实时网络访问、高级推理、代码分析和多文件处理等功能,支持60多种文件格式,具备智能模型选择和强大的错误处理机制。
基于Gemini API的高级推理与反思工具,支持多模型集成与自定义配置
一个为Cursor AI中的Claude提供高级推理能力的MCP服务器,包含多种推理方法和自动迭代功能。
高级推理MCP服务器是一个基于序列思维模式的自包含服务器,具备元认知评估、假设检验、集成记忆库和结构化数据存储等高级认知功能,支持双存储架构(图基记忆和文档存储)和增强可视化。
Thoughtful Claude是一个增强Claude推理能力的MCP服务器,通过集成DeepSeek R1的高级推理引擎,为Claude提供复杂多步推理任务处理能力。
一个通过MCP协议与ChatGPT交互的服务器,用于高级文本分析和推理。
基于Gemini API的高级推理与反思工具
Sequential Thinking Ultra是一个基于MCP协议的高级顺序思维服务器,集成了Ultra Think方法论,提供结构化的问题解决能力。核心功能包括分步处理、质量验证、偏差检测和资源管理,支持自动查询重写和元推理检查点,适用于复杂问题的逐步分析和优化决策。
DeepSeek R1与Claude结合的认知架构项目,通过R1进行高级推理规划,Claude执行具体分析,实现多步骤逻辑推理和结构化思维处理。
DeepSeek MCP Server通过集成DeepSeek R1的高级推理引擎增强Claude的推理能力,使其能够处理复杂的多步推理任务。