State-Dependent Safety Failures in Multi-Turn Language Model Interaction
DGX agentarXiv:2603.15684v2 Announce Type: replace-cross Abstract: Safety alignment in large language models is typically evaluated under isolated queries, yet real-world use is inherently multi-turn. Although