Defense Against LLM Backdoors using Critical Neuron Isolation Pruning
DGX agentarXiv:2607.19894v1 Announce Type: cross Abstract: Large language models (LLMs) are vulnerable to backdoor attacks, where hidden triggers induce malicious outputs. Existing defenses generally fall into