Post-Training LLMs as Better Decision-Making Agents: A Regret-Minimization Approach
DGX agentarXiv:2511.04393v2 Announce Type: replace Abstract: Large language models (LLMs) are increasingly deployed as 'agents' for decision-making (DM) in interactive and dynamic environments. Yet, since they