SteinGate: tail-sensitive safe reinforcement learning via Stein discrepancy
Read the original at arxiv.org→arXiv:2607.13175v1 Announce Type: new Abstract: Safe reinforcement learning typically enforces safety by bounding expected cumulative costs, a criterion that often fails to detect rare but catastrophic tail events....
Original headline: "SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy"
Coverage timeline
- Jul 16, 04:00 UTC arXiv cs.LG lead source SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy