Unlearning Isn't Invisible: Detecting Unlearning Traces in LLMs from Model Outputs
DGX agentarXiv:2506.14003v5 Announce Type: replace Abstract: Machine unlearning (MU) for large language models (LLMs), commonly referred to as LLM unlearning, seeks to remove specific undesirable data or knowl