Disentangling Adversarial Prompts: A Semantic-Graph Defense for Robust LLM Security
arXiv:2605.27823v1 Announce Type: cross Abstract: Large Language Models (LLMs) are increasingly vulnerable to adversarial prompts that exploit semantic ambiguities to bypass safety mechanisms, resulti