VFA: Empowering Multilingual MLLMs via Vision-Free Adaptation
Vision-Free Adaptation (VFA) is proposed, a framework that decouples multilingual language enhancement from visual alignment by composing complementary task vectors over a shared LLM backbone.