Calibrating artificial guilt: neurally grounded reward shaping for prosocial multi-agent reinforcement learning.
Read the original at arxiv.org→arXiv:2608.04663v1 Announce Type: new Abstract: Cooperative multi-agent reinforcement learning often adds social terms to individual rewards, yet the scale of those terms is usually chosen by hand. We ask whether a...
Original headline: "Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning"
Coverage timeline
- Aug 6, 04:00 UTC arXiv cs.AI lead source Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning