ホーム

VLAA-Thinking

Public

[TMLR 25] SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models

作成時間2025-02-27T05:21:28
更新時間2025-11-01T07:54:20
https://ucsc-vlaa.github.io/VLAA-Thinking/
144
Stars
0
Stars Increase

関連プロジェクト