Benchmarking Multimodal CoT Reward Model Stepwise by Visual Program
Paper i proceeding, 2025
multimodal model
reward model
chain of thought
visual programming
Författare
Minghe Gao
Zhejiang University
Universiti Kebangsaan Singapura (NUS)
Xuqi Liu
Zhejiang University
Yue Nick Zhongqi
Nanyang Technological University
Data Science och AI 3
Göteborgs universitet
Yang Wu
Ant group
Shuang Chen
Zhejiang University
Juncheng Li
Zhejiang University
Siliang Tang
Zhejiang University
Fei Wu
Zhejiang University
Tat Seng Chua
Universiti Kebangsaan Singapura (NUS)
Yueting Zhuang
Zhejiang University
Proceedings of the IEEE International Conference on Computer Vision
15505499 (ISSN) 23807504 (eISSN)
1718-17289798331587758 (ISBN)
Honolulu, USA,
Ämneskategorier (SSIF 2025)
Datavetenskap (datalogi)
DOI
10.1109/ICCV51701.2025.00168