Anthropic宣佈其AI模型歷時11天基本自主運行,完成費馬大定理首個端到端、經計算機檢查的Lean形式化證明。該工作並非重新發現數學證明,而是將已有證明轉化爲Lean證明助手可逐步驗證的形式,由Claude生成相關證明內容。
OpenBMB團隊開源數學自動形式化框架、數據集與模型MathForm,目標是用Lean4讓機器準確讀懂並形式化驗證數學定理,攻克通用人工智能核心挑戰。其關鍵不是簡單翻譯自然語言,而是將每個數學概念精準映射到Mathlib庫中,爲數學與AI交叉研究提供新工具。
Mistral AI發佈專爲Lean4設計的開源模型Leanstral1.5,採用Apache-2.0許可。該模型總參數119B,僅6B激活參數,兼顧高性能與低成本。在miniF2F形式數學基準中,驗證集和測試集均達100%完成率,並已挑戰Putnam等高難度推理任務。
歐洲Mistral AI推出數學形式化證明模型Leanstral 1.5,專爲Lean4語言,總參數119B但推理僅激活6B,以極低開銷和Apache-2.0許可完全開源。在miniF2F基準上驗證集和測試集均達100%完成率,PutnamBench同樣表現驚人。
AI生成Lean Canvas工具
AI驅動的精益畫布生成器,免費生成落地頁
數據驅動團隊的產品管理平臺
AI-MO
Kimina-Prover-Distill-0.6B是由Project Numina和Kimi團隊開發的定理證明模型,專注於Lean 4中的競賽風格問題解決能力。它是Kimina-Prover-72B模型的蒸餾版本,在MiniF2F-test上達到了68.85%的準確率。
prithivMLmods
由 Project Numina 和 Kimi 團隊開發的定理證明模型,專注於 Lean 4 中的競賽風格問題解決能力。
由 Numina 項目和 Kimi 團隊開發的定理證明模型,專注於提升在 Lean 4 中的競賽式問題解決能力。
Kimina-Prover-Distill-8B 是由 Project Numina 和 Kimi 團隊開發的定理證明模型,專注於 Lean 4 中的競賽風格問題解決能力。
unsloth
專為 Lean 4 形式化定理證明設計的開源大型語言模型,通過遞歸定理證明流程和強化學習訓練,實現了卓越的準確性。
deepseek-ai
專為Lean 4形式化定理證明設計的開源大語言模型,通過遞歸定理證明流程收集數據,結合非正式和形式化的數學推理。
FrenzyMath
Herald是一個自然語言標註的Lean 4數據集,主要用於自然語言處理和形式化驗證領域的研究。
ByteDance-Seed
BFS-Prover是Lean4中最先進的定理證明系統,基於Qwen2.5-Math-7B大語言模型開發,能夠根據Lean4中的證明狀態自動生成策略,逐步推進數學定理的證明過程。
internlm
InternLM-Step-Prover 是一款基於 7B 語言模型的先進 LEAN4 步驟證明器,在 Lean-Github 和多個合成數據集上訓練,在 MiniF2F、ProofNet 和 Putnam 等數學基準測試中表現出色,展示了強大的形式化數學證明能力。
kaiyuy
LeanDojo 是一個基於檢索增強語言模型的定理證明系統,旨在通過結合語言模型和檢索技術來提升自動定理證明的能力。
這是一個為VSCode設計的MCP服務器,專門用於搜索Lean Mathlib 4的文檔,允許用戶查詢聲明、模塊和實例並獲取相關文檔鏈接和詳細信息。
QuantConnect Lean算法交易引擎一體化Docker鏡像,支持GPU自動選擇、現代Web界面、REST API和MCP協議集成
LeanIX MCP集成項目提供了一個連接LeanIX與AI助手的MCP服務器,通過5個MCP工具暴露LeanIX的GraphQL API功能,包括查看統計、搜索、訂閱管理、創建和更新數據表等功能。