CoDrift: Compositional drifting for offline reinforcement learning
Read the original at arxiv.org→arXiv:2608.23939v1 Announce Type: new Abstract: Offline reinforcement learning is intrinsically multi-objective: a policy must remain compatible with the behavioral support of a fixed dataset while preferentially...
Original headline: "CoDrift: Compositional Drifting for Offline Reinforcement Learning"
Coverage timeline
- Aug 26, 04:00 UTC arXiv cs.LG lead source CoDrift: Compositional Drifting for Offline Reinforcement Learning