小米近日开源了视觉-语言-动作大模型Xiaomi-Robotics-0的真机后训练全流程,推动具身智能发展。团队仅用约20小时任务数据训练,就让机器人掌握精准收纳耳机等高难度操作,展示了快速学习复杂技能的能力。
小米继2月开源VLA大模型Xiaomi-Robotics-0后,近日公布其真机后训练全流程,旨在解决机器人从实验室到实际生产的“最后一公里”问题。演示中,搭载该模型的机器人仅用20小时训练便展现出精细操作能力,推动AI机器人成为开箱即用的生产力工具。
小米开源47亿参数机器人模型Xiaomi-Robotics-0,采用MoT混合架构,通过“大脑”与“小脑”协同工作,在消费级显卡上实现实时推理,解决现有VLA模型因推理延迟导致动作迟缓的问题,提升机器人控制效率与泛化能力。