Cordyceps: Covert Control Attacks on LLMs via Data Poisoning
DGX agentarXiv:2605.26595v1 Announce Type: cross Abstract: Large language models (LLMs) are often fine-tuned on uncurated text datasets that adversaries can poison. Existing poisoning attacks primarily rely on