VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning
Conference on Neural Information Processing Systems (NeurIPS), 2025, spotlight
Haozhe Wang, Chao Qu, Zuming Huang, Wei Chu, Fangzhen Lin, Wenhu Chen
🏆 Spotlight
[PDF] [Code]
