Unified algorithmic framework for hybrid reinforcement learning in tabular MDPs with shifted transition dynamics
Read the original at arxiv.org→arXiv:2607.25207v1 Announce Type: new Abstract: This paper investigates a hybrid reinforcement learning setting in tabular Markov Decision Processes (MDPs), where an agent aims to learn an optimal policy by...
Original headline: "A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics"
Coverage timeline
- Jul 29, 04:00 UTC arXiv cs.LG lead source A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics