在Build2026大會上,微軟發佈首款高級推理模型MAI-Thinking-1,擁有350億參數,在軟件工程基準測試中達領先水平。該模型基於乾淨數據從零訓練,未使用外部來源數據,標誌着微軟在自研AI及全場景矩陣構建上邁出關鍵一步。
2026年5月20日,OpenAI的推理模型成功推翻數學大師保羅·Erdős於1946年提出的“單位距離猜想”,解決了離散幾何領域近80年的核心難題。與以往不同,該成果獲學術界廣泛認可,標誌着AI從“檢索”到“原創”的關鍵突破。
OpenAI最新推理模型成功推翻數學家保羅·Erdős在1946年提出的單位距離猜想,首次依靠自身長鏈推理能力自主攻克數學核心開放難題。這一里程碑式突破經專家獨立驗證,標誌着人工智能從檢索式解答邁入原創性證明階段。
加拿大初創企業Cohere與德國初創企業Aleph Alpha達成200億美元合作,共同開發“主權”人工智能系統,旨在建立不依賴美國和中國的人工智能架構,推進跨大西洋技術自主性。Cohere專注自然語言處理,Aleph Alpha擅長推理模型,雙方將結合技術優勢,加速AI自主發展。
基於LLaMA-3.1 8B的小型推理模型,實現透明可控的AI推理。
AI推理模型,解決複雜問題的新系列。
Xai
$1.4
輸入tokens/百萬
$3.5
輸出tokens/百萬
2k
上下文長度
Openai
$7.7
$30.8
200
-
Anthropic
$105
$525
Google
$0.7
$2.8
1k
$7
$35
$2.1
$17.5
$21
Alibaba
$1
$10
256
$6
$24
$2
$20
$4
$16
Baidu
128
Bytedance
$1.2
$3.6
4
$3.9
$15.2
64
Moonshot
$0.8
danielkty22
TARS-SFT-7B是一個基於監督微調的安全推理模型,作為強化學習訓練的基礎模型,專門設計用於增強AI系統的安全性。該模型從Qwen2.5-7B-Instruct開始訓練,通過推理過程作為自適應防禦機制來提升模型的安全性能。
Smilyai-labs
SmilyAI實驗室開發的第二代推理模型,具有諷刺反派風格AI人格,採用結構化推理輸出
unsloth
MAI-DS-R1 是 DeepSeek-R1 推理模型,經過微軟 AI 團隊的後續訓練,以提升其在受限話題上的響應能力並優化其風險表現,同時保持其推理能力和競爭性能。
nvidia
基於Qwen2.5-14B微調的數學推理模型,在AIMO-2 Kaggle競賽中獲得第一名
microsoft
MAI-DS-R1是微軟AI團隊對DeepSeek-R1推理模型進行後訓練的成果,旨在提升其對敏感話題的響應能力並優化風險表現,同時保持原有的推理能力和競爭優勢。
MAI-DS-R1是微軟AI團隊對DeepSeek-R1推理模型進行後訓練的成果,旨在提升其對敏感話題的響應能力並優化風險表現,同時保持原有推理能力和競爭優勢。
scb10x
颱風T1 3B是SCB 10X開發的新型開放推理模型系列的首款產品。該模型基於Llama 3.2架構,具備跨領域推理能力,在GPQA、MMLU Pro和AI數學奧林匹克等基準測試中表現優異,特別支持泰語推理過程生成。
mismayil
Atomic 2020是一個基於常識知識圖譜的神經符號推理模型,由Allen AI研究所開發。該模型基於BART架構訓練,能夠生成和理解日常事件之間的因果關係、社會常識和心理狀態推理。