Preprint
Aug 2026
From Prompting to Behavioral Alignment: Personalized LLM Judges for Recommendation Evaluation
A sequential behavioral alignment framework pairing fine-tuning with preference optimization over paired correct and counterfactual rationales is developed and applied, demonstrating that behavioral alignment mitigates bidirectional rationalization while delivering human-interpretable reasoning traces without manual pipeline overhead.
Alireza S. Ziabari, Kat Ellis, Colleen E. Chan et al.
· 0 citations