Personalizing Causal Audio-Driven Facial Motion via Dynamic Multi-modal Retrieval
arXiv:2604.23692v1 Announce Type: cross Abstract: Audio-driven facial animation is essential for immersive digital interaction, yet existing frameworks fail to reconcile real-time streaming with high-