小米近日開源了視覺-語言-動作大模型Xiaomi-Robotics-0的真機後訓練全流程,推動具身智能發展。團隊僅用約20小時任務數據訓練,就讓機器人掌握精準收納耳機等高難度操作,展示了快速學習複雜技能的能力。
小米繼2月開源VLA大模型Xiaomi-Robotics-0後,近日公佈其真機後訓練全流程,旨在解決機器人從實驗室到實際生產的“最後一公里”問題。演示中,搭載該模型的機器人僅用20小時訓練便展現出精細操作能力,推動AI機器人成爲開箱即用的生產力工具。
小米開源47億參數機器人模型Xiaomi-Robotics-0,採用MoT混合架構,通過“大腦”與“小腦”協同工作,在消費級顯卡上實現實時推理,解決現有VLA模型因推理延遲導致動作遲緩的問題,提升機器人控制效率與泛化能力。