欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、KimiK3开源,2.8万亿参数登顶全球最大开源模型,马斯克也来点了个赞KimiK3的发布标志着中国在大模型领域取得了重要进展,其强大的性能和开源策略对AI行业产生了深远影响。此次事件凸显了AI产品在数据权限管理和搜索引擎索引控制方面的重要性。
针对美国政府或禁特定国家开源AI模型的传闻,Anthropic CEO阿莫代伊公开声明,从未提议或主张封禁开源。此事引发行业激烈讨论,多家科技企业联名支持开源模式,部分声音质疑Anthropic意图借行政禁令打压对手、维护自身商业利益。
7月27日,美团上线全场景AI Agent平台CatPaw,搭载刚开源的万亿参数大模型LongCat2.0。该模型总参数1.6T,原生支持1M超长上下文,首次在五万张国产算力卡上完成全流程训练与推理。CatPaw将这一底层能力转化为开箱即用的企业级智能工作台与Agent开发托管平台,标志着美团大模型从技术开源全面迈向产业落地。
硅谷AI开源路线辩论白热化。OpenAI与Anthropic以国家安全为由游说推动限制中国开源模型,而黄仁勋、纳德拉、马斯克、扎克伯格、皮查伊等公开支持开源,阵营交锋。核心争议是中国开源AI快速崛起,智谱、月之暗面等近期发布新模型,挑战美国领先地位。
最快、最可靠的推理平台,可部署和扩展开源及自定义AI模型
开源的前沿语音 AI 模型,支持语音识别和文本转语音。
开源AI模型,用单张照片生成口型同步说话视频,免费在线体验。
开源LLM路由器,路由请求到最具成本效益模型,节省70% AI令牌成本。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$6
$24
$2
$20
XiaomiMiMo
米模具身模型(MiMo-Embodied)是一款强大的跨具身视觉语言模型,在自动驾驶和具身AI任务中均展现出了卓越的性能。它是首个将这两个关键领域相结合的开源视觉语言模型,显著提升了在动态物理环境中的理解和推理能力。
allenai
Olmo 3是由Allen Institute for AI开发的开源语言模型系列,包含7B和32B两种规格,分为指令(Instruct)和思考(Think)两种变体。该模型具有出色的长链思维能力,能够显著提升数学和编码等推理任务的表现。
Olmo 3是Allen Institute for AI (Ai2)开发的全新32B参数语言模型家族,包含Base、Instruct和Think等变体。该模型基于Dolma 3数据集训练,支持65,536的长上下文处理,旨在推动语言模型科学发展。模型完全开源,遵循Apache 2.0许可证。
moonshotai
Kimi K2 Thinking 是月之暗面(Moonshot AI)开发的最新一代开源思维模型,具有强大的深度推理能力和工具调用功能。该模型采用混合专家架构,支持原生INT4量化,拥有256k上下文窗口,在多个基准测试中表现出色。
SadraCoding
SDXL-Deepfake-Detector 是一款精准检测 AI 生成人脸的工具,专注于维护数字世界的真实性,为抵御视觉虚假信息提供隐私保护且开源的解决方案。该模型通过微调预训练模型实现轻量级且高准确率的检测。
unsloth
Granite-4.0-Micro是IBM开发的具有30亿参数的长上下文指令模型,基于Granite-4.0-Micro-Base微调而来。该模型使用了开源指令数据集和内部合成数据集,具备增强的指令遵循和工具调用能力,支持多语言任务,可作为各领域AI助手的基础模型。
GeneralAnalysis
GA Guard Lite是General Analysis开发的轻量级开源审核模型,专门用于检测语言模型输出中的违规内容。该模型能够识别七类安全风险,包括非法活动、仇恨言论、个人信息泄露等,为AI应用提供高效的内容安全防护。
GA Guard Core是General Analysis开发的开源审核模型,专门用于检测和分类七类违规内容,包括非法活动、仇恨言论、个人信息泄露等,确保AI应用的安全性和合规性。
Jackmin108
GLM-4.5-Air是智谱AI推出的适用于智能体的基础模型,采用紧凑设计,统一了推理、编码和智能体能力,能满足智能体应用的复杂需求。该模型参数量适中且效率优越,已开源多种版本,可用于商业和二次开发。
manuelcaccone
Gemma-3 ActuaryEnough2是一款专为精算领域打造的AI模型,基于超过11,000个精算问答对进行微调训练,能够将简单的保险问题转化为严谨的精算专业语言。该模型为ActuaryEnough提供支持,以开源形式发布供教育和研究使用。
TildeAI
TildeOpen LLM 是一个开源的基础语言模型,专门为服务代表性不足的北欧和东欧语言而设计。该模型由欧盟委员会资助,在LUMI超级计算机上训练,拥有300亿参数,解决了19种重点语言使用者在现有AI系统中面临的性能差距问题。
Devstral 1.1是由Mistral AI和All Hands AI合作开发的智能大语言模型,专为软件工程任务设计。该模型在SWE-bench基准测试中表现出色,位列开源模型榜首,拥有240亿参数和128k tokens的长上下文窗口。
Devstral是一款专为软件工程任务打造的大语言模型,由Mistral AI和All Hands AI合作开发。在SWE-bench基准测试中表现优异,是排名第一的开源模型。
zai-org
GLM-4.1V-9B-Base是智谱AI开发的开源视觉语言基础模型,拥有90亿参数,专注于多模态推理能力,支持中英双语,处理高达4K分辨率的图像和64K上下文长度。
deepseek-community
DeepSeek-VL是由DeepSeek AI团队开发的开源视觉语言模型,能够同时处理文本和图像信息,生成上下文相关的回复。该模型采用混合视觉编码器,支持高分辨率图像处理,在真实世界的视觉语言理解应用中表现出色。
Multiverse4FM
Multiverse-32B是基于Multiverse构建的首个开源、非自回归模型,在AIME测试中表现优异,具有重要的学术和应用价值。
RedHatAI
Granite-3.1-8B-Instruct 是一个具有80亿参数的长上下文指令模型,基于Granite-3.1-8B-Base微调而来。它结合了开源指令数据集和内部合成数据集,专门设计用于有效解决长上下文问题,支持多种语言和多种AI任务。
GLM-4-Z1-9B-0414是智谱AI推出的新一代90亿参数开源大语言模型,具有强大的文本生成和推理能力。该模型在数学推理和通用任务方面表现出色,在资源受限场景下实现了效率与效果的出色平衡,支持友好的本地部署。
Mungert
Granite-3.2-2B-Instruct是一个20亿参数的长上下文AI模型,专为思维推理能力微调。基于Granite-3.1-2B-Instruct构建,通过混合使用宽松许可的开源数据集和内部生成的合成数据训练,旨在提升推理任务表现。
OLMo 2 32B是艾伦人工智能研究院(AI2)推出的开放语言模型系列中规模最大的32B参数模型,基于Apache 2.0许可开源,支持英语语言处理。
Klavis AI是一个开源项目,提供在Slack、Discord和Web平台上简单易用的MCP(模型上下文协议)服务,包括报告生成、YouTube工具、文档转换等多种功能,支持非技术用户和开发者使用AI工作流。
Genkit是一个用于构建AI驱动应用的开源框架,提供Node.js和Go库,支持多种AI模型和向量数据库集成,包含开发工具和插件生态系统。
assistant-ui是一个开源TypeScript/React库,用于快速构建生产级AI聊天界面,提供可组合的UI组件、流式响应、无障碍访问等功能,支持多种AI后端和模型。
OpenDia是一款开源浏览器扩展工具,允许AI模型直接控制用户浏览器,利用现有登录状态、书签等数据进行自动化操作,支持多种浏览器和AI模型,注重隐私保护。
Flutter MCP Server是一个开源的Dart/Flutter生态模型上下文协议(MCP)实现,为AI助手和开发者工具提供统一的API接口,支持远程调用Dart/Flutter开发工具链,实现安全、可编程的自动化开发流程。
Portainer MCP是一个实现模型上下文协议(MCP)的开源项目,通过标准化接口将AI助手与Portainer容器管理平台连接,支持查询和管理Docker/Kubernetes环境。
OpenAlex MCP Server是一个开源项目,实现了模型配置协议(MCP),为AI助手提供全球学术文献的结构化访问服务。
Dynatrace Managed MCP服务器是一个开源项目,允许AI助手通过模型上下文协议(MCP)与自托管的Dynatrace Managed部署进行交互,将可观测性数据直接集成到AI辅助工作流中。它支持本地和远程模式,可配置多个环境,提供问题、安全、实体、SLO、事件、日志和指标等数据的查询能力。
mcp-servers-for-revit 是一个通过模型上下文协议(MCP)连接AI助手与Autodesk Revit的开源项目,允许AI客户端读取、创建、修改和删除Revit项目中的元素。
LOTUS-MCP是一个开源的模型协调协议,整合Mistral和Gemini两大AI模型,提供统一接口、上下文共享和工具集成,实现智能路由和成本优化。
WinBridgeAgent是一个开源的Windows本地能力服务,实现了模型上下文协议标准,为AI助手提供可追溯的Windows系统操作功能。
SEC EDGAR MCP是一个开源MCP服务器,连接AI模型与美国证券交易委员会(SEC)的EDGAR数据库,提供公司财务数据查询工具。
SolidPilot是一个开源的SolidWorks AI助手,采用模块化架构,通过MCP协议与本地语言模型(如Claude)交互,包含Python层、C#适配层和COM桥接等技术组件。
NetBrain MCP是一个开源网络运维平台,通过Model Context Protocol连接大型语言模型与网络设备,实现AI驱动的网络配置、诊断和管理,并提供专业的Web终端界面和网络拓扑可视化功能。
Lspace是一个开源API后端和服务器,实现了模型上下文协议(MCP),帮助开发者将AI会话中的见解转化为可搜索的持久知识库,并集成到各种工具中。
Trellis MCP是一个连接AI助手与Trellis 3D生成模型的接口服务,支持通过自然语言快速生成3D资产并导入Blender。该项目基于开源模型,需自行部署API后端,具有快速、免费的特点,但存在稳定性风险。
Createve.AI Nexus是一个开源项目,通过实现模型上下文协议(MCP)标准,为AI代理与企业系统之间搭建桥梁,提供安全、实时的数据访问和系统集成能力。它支持多种AI平台,具备企业级安全架构,并能连接各类业务应用、传感器数据和文档管理系统。
MCP.science是一个开源项目,提供多种MCP服务器,专为科学研究应用设计,使AI模型能通过标准化协议与科学数据、工具和资源交互。
Model Context Protocol (MCP) 是一个开源协议,提供了一系列参考实现和社区开发的服务器,旨在为大型语言模型(LLM)提供安全、可控的工具和数据源访问。这些服务器展示了MCP的多样性和可扩展性,涵盖了从文件系统操作到数据库集成、从网络搜索到AI图像生成等多种功能。
Blender与本地AI模型集成的开源项目,通过自然语言控制3D建模。