Marginal coverage credit reduces redundant exploration in parallel state-entropy optimization
Read the original at arxiv.org→arXiv:2608.27507v1 Announce Type: new Abstract: Policy Gradient for Parallel State Entropy maximization (PGPSE) expands state-space coverage by training independently parameterized policies in replicated copies of...
Original headline: "Marginal Coverage Credit Reduces Redundant Exploration in Parallel State-Entropy Optimization"
Coverage timeline
- Aug 31, 04:00 UTC arXiv cs.LG lead source Marginal Coverage Credit Reduces Redundant Exploration in Parallel State-Entropy Optimization