Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack
arXiv:2605.25194v1 Announce Type: new Abstract: Adversarial images pose a severe security threat to multimodal large language models through prompt injection. Existing defenses largely lack a principl