首页

VLAA-Thinking

Public

[TMLR 25] SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models

创建时间2025-02-27T05:21:28
更新时间2025-12-02T23:41:02
https://ucsc-vlaa.github.io/VLAA-Thinking/
144
Stars
0
Stars Increase

相关项目