Characterizing a configuration where inference-time PRM-pruned fragment grafting is inert: evidence from three reasoning LMs
Read the original at arxiv.org→arXiv:2610.00047v1 Announce Type: new Abstract: Diversity collapse in parallel chain-of-thought has motivated inference-time interventions built on a natural design: when a process reward model (PRM) prunes a chain,...
Original headline: "Characterizing a Configuration Where Inference-Time PRM-Pruned Fragment Grafting Is Inert: Evidence from Three Reasoning LMs"
Coverage timeline
- Oct 2, 04:00 UTC arXiv cs.AI lead source Characterizing a Configuration Where Inference-Time PRM-Pruned Fragment Grafting Is Inert: Evidence from Three Reasoning LMs