Harmonious Parameter Adaptation in Continual Visual Instruction Tuning for Safety-Aligned MLLMs
arXiv:2511.20158v2 Announce Type: replace Abstract: While continual visual instruction tuning (CVIT) has shown promise in adapting multimodal large language models (MLLMs), existing studies predominan