視覚大規模モデルは高性能達成に膨大なデータと計算資源が必要で、これまで一部のチームの独占だった。7月21日、小鵬集団は高効率視覚エンコーダーTuringViTを発表。アーキテクチャ・データ・訓練工程を再構築し、再現可能で低コストな最先端のViT訓練手法を提供、先進的視覚機能の業界普及を推進する。....