小米は最近、視覚-言語-動作大規模モデルXiaomi-Robotics-0の実機後の学習フローをオープンソース化しました。これにより、身体を持つ知能の発展が促進されます。チームは約20時間のタスクデータのみを使用して、ロボットにイヤホンの正確な収納などの高難度操作を習得させ、複雑なスキルを迅速に学ぶ能力を示しています。
小米は2月にVLA大規模モデル「Xiaomi-Robotics-0」を公開した後、実際のロボット後訓練の全工程を発表。実験室から生産現場への「最後の1キロ」問題を解決する。デモでは、20時間の訓練で精密操作能力を示し、AIロボットをすぐ使える生産ツールに変える。....
小米が47億パラメータのロボットモデルXiaomi-Robotics-0をオープンソース化し、MoTミックスアーキテクチャを採用。脳と小脳が協力して働き、モバイル向けGPUでリアルタイム推論を実現し、現在のVLAモデルが推論遅延によって動作が鈍くなる問題を解決し、ロボットの制御効率と汎化能力を向上させました。