Unifying Speech Editing Detection and Content Localization via Prior-Enhanced Audio LLMs
arXiv:2601.21463v2 Announce Type: replace-cross Abstract: Existing speech editing detection (SED) datasets are predominantly constructed using manual splicing or limited editing operations, resulting