稀宇科技(MiniMax)被曝即将推出参数高达2.7万亿的新一代大模型,旨在破解复杂任务处理和逻辑推理难题。此举不仅彰显了其对底层技术研发的持续重注,也映射出行业通过参数跃进追逐更高智能水平的雄心。
近日马斯克在社交平台宣布,新一代大语言模型Grok 4.5已在SpaceX和特斯拉启动内部私测,从实验室迈向复杂工业场景。该模型以1.5万亿参数V9架构为基座,引入AI编程工具Cursor进行补充训练,以增强逻辑推理能力,推动AI在航天与汽车领域实际部署。
Anthropic于5月29日发布旗舰大模型Claude Opus4.8,在保持原价基础上,重点升级智能体编程、复杂逻辑推理和多领域知识工作能力。测试反馈显示,该模型日常表现更稳健,判断更敏锐,尤其擅长处理复杂多步骤任务。
阿里云通义千问大模型推出Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview预览版,已上线大模型竞技场及官方Qwen Chat。两款模型作为新一代旗舰预览版,仅支持“思考模式”,专注高难度逻辑推理与深度计算,预计在阿里云峰会正式发布。
业界首个超大规模混合 Mamba 推理模型,强推理能力。
DeepSeek 是一款先进的 AI 语言模型,擅长逻辑推理、数学和编程任务,提供免费使用。
使用开源模型Llama-3.1 70b在Groq上创建类似o1的推理链
评估大型语言模型的逻辑推理和上下文理解能力。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$7
$35
Google
$2.1
$17.5
$21
$105
$0.7
Alibaba
$4
$16
$1
$10
256
$2
$20
$6
$24
Baidu
128
Moonshot
Bytedance
$0.8
32
TeichAI
这是一个基于Qwen3 30B A3B模型,在Claude Sonnet 4.5高推理难度数据集上训练的蒸馏模型。该模型专门针对复杂推理任务进行优化,在编码和科学领域表现出色,具备较强的逻辑推理能力。
nightmedia
LFM2-8B-A1B-qx86-hi-mlx是基于MLX格式的高效推理模型,从LiquidAI/LFM2-8B-A1B转换而来。该模型采用混合专家架构,在推理任务中表现出卓越的效率,特别擅长复杂逻辑推理任务,同时支持多语言处理。
DavidAU
这是一个基于Qwen3架构的6B参数大语言模型,专门针对恐怖主题进行微调,能够生成暗黑、恐怖风格的文本,同时在逻辑推理任务中表现出色。
inclusionAI
Ring-mini-2.0是基于Ling 2.0架构深度优化的高性能推理型MoE模型,仅有160亿总参数和14亿激活参数,却实现了与100亿规模以下密集模型相当的综合推理能力。在逻辑推理、代码生成和数学任务方面表现出色,支持12.8万长上下文处理和每秒300+令牌的高速生成。
NousResearch
Hermes 4 14B是由Nous Research基于Qwen 3 14B开发的前沿混合模式推理模型,在数学、代码、STEM、逻辑推理、创造力和格式保真输出等方面有显著提升,同时保持了通用助手的质量和广泛的中立对齐。
NexaAI
NexaAI/Qwen3-0.6B是基于Qwen3系列的0.6B参数语言模型,在推理、指令遵循、多语言支持等方面表现出色。支持思维模式和非思维模式无缝切换,适用于复杂逻辑推理和高效通用对话。
cpatonn
Qwen3-30B-A3B-Thinking-2507是经过量化处理的大语言模型,具有增强的推理能力、通用能力和长上下文理解能力。该模型采用混合专家架构,在逻辑推理、数学、科学、编码等复杂任务上表现出色,支持262,144 tokens的长上下文处理。
ELVISIO
Qwen3-30B-A3B-Instruct-2507-AWQ 是 Qwen3-30B-A3B-Instruct-2507 的 AWQ int4 量化版本,具有 305 亿总参数和 33 亿激活参数。该模型在指令遵循、逻辑推理、文本理解、数学、科学、编码和工具使用等方面有显著改进,支持 256K 长上下文理解能力,可与 Transformers 和 vLLM 兼容高效进行文本生成。
Qwen3-30B-A3B-Instruct-2507是阿里云推出的305亿参数混合专家模型,采用非思考模式,在指令遵循、逻辑推理、文本理解、数学科学、编码和工具使用等方面表现优异,支持262K长上下文和多语言处理。
prithivMLmods
Qwen3代码推理是一个参数量为40亿的紧凑型模型,在nvidia/OpenCodeReasoning上进行了微调,专门为编码和逻辑推理任务而设计。该模型在代码生成和逻辑问答方面表现出色,支持超过10000个标记的上下文窗口。
QuantTrio
Qwen3-235B-A22B-Instruct-2507-AWQ是基于Qwen3-235B-A22B-Instruct-2507基础模型的量化版本,是一个235B参数规模的混合专家模型(MoE),激活参数为22B。在文本生成、指令遵循、逻辑推理等方面表现优异,支持长达262K的上下文长度。
Mungert
Granite-8B-Code-Instruct-4K是IBM Research开发的80亿参数代码指令模型,基于Granite-8B-Code-Base-4K在多种指令数据上微调而成。该模型增强了指令跟随、逻辑推理和问题解决能力,专门用于构建编码助手,支持多种编程语言。
beetleware
基于Qwen3-14B微调的阿拉伯语逻辑推理大语言模型,专为提升阿拉伯语逻辑推理能力优化
beetlware
基于Qwen3-14B微调的阿拉伯语逻辑推理大模型,优化了阿拉伯语逻辑和演绎推理能力,同时保留通用对话能力。
LLM360
Guru-7B是基于Qwen2.5-7B的强化学习推理模型,在论文《Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective》中提出。该模型在数学、代码、科学、逻辑推理等多个领域展现出卓越的推理能力,在多项基准测试中表现优异。
cortexso
INTELLECT-2是由Prime Intellect发布的320亿参数大语言模型,基于Qwen2架构构建,专注于数学、编码和逻辑推理任务。
bunyaminergen
基于Qwen2.5-Coder-1.5B-Instruct微调的代码推理模型,增强了编程问题解决和逻辑推理能力
基于Qwen-1.5B微调的紧凑型多语言推理模型,擅长数学解题、逻辑推理、代码生成和通用任务
GusPuffy
Synthia-S1-27b是由Tesslate AI开发的高级推理AI模型,专注于逻辑推理、编码和角色扮演任务。
CreitinGameplays
基于Mistral-Nemo-Instruct-2407微调的大语言模型,专注于系统性逻辑推理和分步解答能力。
MCP逻辑求解器是一个结合大型语言模型与形式化定理证明能力的强大推理系统,支持自然语言和一阶逻辑输入,通过Prover9/Mace4进行自动验证,并提供结构化推理和解释。
MCP-RoCQ是一个基于Coq证明助手的逻辑推理服务器,提供类型检查、归纳类型定义和属性证明功能。
任务门户系统是一个自我演进的通用问题解决机构,具备逻辑推理、伦理框架、序列思考和元框架等核心组件,能够安全地自我进化并解决复杂问题。
MCP-Logic是一个基于MCP协议的逻辑推理服务器,为AI系统提供自动化定理证明和模型验证功能。
一个自包含的MCP服务器,用于一阶逻辑推理,支持定理证明、模型查找和反例检测,采用多引擎架构自动选择最佳推理引擎。
DeepSeek R1与Claude结合的认知架构项目,通过R1进行高级推理规划,Claude执行具体分析,实现多步骤逻辑推理和结构化思维处理。