小米开源最新多模态大模型 Xiaomi MiMo-VL-7B-2508

AIbase基地

发布于AI新闻资讯 · 1 分钟阅读 · Aug 9, 2025

716

小米大模型团队宣布开源最新一代多模态大模型 Xiaomi MiMo-VL-7B-2508，包含 RL 与 SFT 两个版本。

官方数据显示，新版模型在学科推理、文档理解、图形界面定位及视频理解四项核心能力上全面刷新纪录，其中 MMMU 基准首次突破70分大关，ChartQA 升至94.4，ScreenSpot-v2达92.5，VideoMME 提升至70.8。

微信截图_20250809102003.png

此番迭代通过优化强化学习稳定性与监督微调流程，使模型在内部 VLM Arena 评分从1093.9跃升至1131.2。

尤为引人关注的是，用户可在提问时通过“/no_think”指令自由切换“思考”与“非思考”模式:前者全程展示推理链条，控制成功率100%，后者直接生成答案，响应更快，成功率99.84%。

MiMo-VL-7B-RL-2508

推荐用户在大多数情况下体验使用该模型。
开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-RL-2508

MiMo-VL-7B-SFT-2508

用户可以根据实际需求，基于此模型进行SFT以及RL。相比于上一版SFT模型，该模型的RL稳定性更高。
开源地址:https://huggingface.co/XiaomiMiMo/MiMo-VL-7B-SFT-2508

小米多模态大模型 XiaomiMiMo-VL-7B-2508 AI新词

本文来自AIbase日报

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南，每天我们为你呈现AI领域的热点内容，聚焦开发者，助你洞悉技术趋势、了解创新AI产品应用。

—— 由AIbase 日报组创作

OpenAI高薪挖投行人才：年薪 139 万加股权，要用AI重塑华尔街

OpenAI正招募投行专家加入旧金山AI团队，担任“主题专家”以“教授”而非使用AI。该岗位年薪高达20.5万美元，并附带股权激励，背景是其已秘密筹备IPO。此举凸显OpenAI正积极吸纳金融专才，以深化在投资领域的布局。

2026年7月8号 17:33

210

AI日报：Claude Cowork登陆网页和手机端；美国放行GPT-5.6；Meta超级智能实验室首发图像生成模型

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南，每天我们为你呈现AI领域的热点内容，聚焦开发者，助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解：https://app.aibase.com/zh1、Meta超级智能实验室首发图像生成模型：MuseImage免费登陆Instagram和WhatsAppMeta超级智能实验室推出了首个图像生成模型MuseImage，该模型已通过MetaAI应用免费提供，并同步登陆Instagram和WhatsApp。近九成玩家会在购买前查看AI相关披露信息，但多数人并不将其作为购买决策的关键因素。

2026年7月8号 16:46