Compositional reasoning in language models under reinforcement learning post-training
Read the original at arxiv.org→arXiv:2609.19465v1 Announce Type: new Abstract: Compositional reasoning is critical for real-world problem solving: since training data is necessarily limited, models must generalize by composing learned skills in...
Original headline: "Compositional Reasoning in Language Models under Reinforcement Learning Post-Training"
Coverage timeline
- Sep 18, 04:00 UTC arXiv cs.AI lead source Compositional Reasoning in Language Models under Reinforcement Learning Post-Training
- Sep 18, 04:00 UTC arXiv cs.CL Reflective Recovery: A Self-Supervised Method for Reasoning by Learning from Mistakes