Conference
Open access
2026
Omni-RewardBench: Toward a Comprehensive Evaluation of Generative Reward Models Across Modalities
Omni-RewardBench is introduced, the first benchmark for comprehensive evaluation of ORMs across modalities and demonstrates that current OLLMs fall short as reward models, revealing several common failure modes such as perception failure, modality dominance failure, and cross-modal fusion failure.
Chi-Min Chan, Yujin Zhou, Pengcheng Wen et al.
· Annual Meeting of the Associ... · 0 citations