谷歌DeepMind推出GenCeption模型,將視頻生成AI逆向改造爲視覺分析引擎,單一模型即可同時完成深度估計、圖像分割、3D姿態估計等五項核心視覺任務。模型基於阿里通義萬相Wan2.1框架訓練,一次前向傳播實現預測,打破任務孤立格局。
谷歌DeepMind發佈GenCeption,基於預訓練視頻生成模型,統一解決深度估計、圖像分割、3D姿態估計等任務,性能接近或超越專用模型,且訓練數據需求遠低。這挑戰了當前以Segment Anything、Depth Anything等專用模型爲主的格局。