Feedback-driven rule induction and retrieval-augmented bias mitigation for large language models
Large Language Models (LLMs) are becoming widely adopted for reasoning and decision-support tasks, yet they can inherit and reproduce gender-related biases present in their training data. Most existing bias-mitigation strategies depend on fine-tuning, reinforcement learning, prompt engineering, or interventions dur...