Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning
DGX agentarXiv:2608.09507v1 Announce Type: cross Abstract: Natural language user preferences provide an interpretable interface for LLM personalization. However, universal preference summaries often contain in