Preprint
Jul 2026
Debiasing Text-to-Image Evaluation via Implicit Cultural Alignment Reward Modeling
An Implicit Cultural Alignment Reward Model built upon a lightweight 4.2-billion-parameter Multimodal Large Language Model (MLLM) integrated with a Skip-connection Cross-Attention mechanism, enabling late-stage semantic features to directly attend to early-stage visual representations and better preserve culturally salient details.
Boxin Chang, Yu-Chih Chen
· 0 citations