Benchmarking Multimodal CoT Reward Model Stepwise by Visual Program
Paper in proceeding, 2025
multimodal model
reward model
chain of thought
visual programming
Author
Minghe Gao
Zhejiang University
National University of Singapore (NUS)
Xuqi Liu
Zhejiang University
Yue Nick Zhongqi
Nanyang Technological University
Data Science and AI 3
University of Gothenburg
Yang Wu
Ant group
Shuang Chen
Zhejiang University
Juncheng Li
Zhejiang University
Siliang Tang
Zhejiang University
Fei Wu
Zhejiang University
Tat Seng Chua
National University of Singapore (NUS)
Yueting Zhuang
Zhejiang University
Proceedings of the IEEE International Conference on Computer Vision
15505499 (ISSN) 23807504 (eISSN)
1718-17289798331587758 (ISBN)
Honolulu, USA,
Subject Categories (SSIF 2025)
Computer Sciences
DOI
10.1109/ICCV51701.2025.00168