Preprint
Aug 2026
Context Blindness in DPO: Mitigating Object Hallucination in MLLMs via Context-Calibrated Preference Optimization
Context-Calibrated DPO (C$^2$-DPO), which directly maximizes CPG while preserving the original preference ordering, is proposed, which substantially reduces hallucination without compromising general reasoning.
Byungoh Ko, Jinyoung Park, Jongha Kim et al.
· 0 citations