A Novel Automatic Framework for Speaker Drift Detection in Synthesized Speech
DGX agentarXiv:2604.06327v1 Announce Type: cross Abstract: Recent diffusion-based text-to-speech (TTS) models achieve high naturalness and expressiveness, yet often suffer from speaker drift, a subtle, gradual