Offline-Online Reinforcement Learning for Linear Mixture MDPs
DGX agentarXiv:2604.11994v1 Announce Type: new Abstract: We study offline-online reinforcement learning in linear mixture Markov decision processes (MDPs) under environment shift. In the offline phase, data ar