OBC-Prune: outcome-based calibration for large reasoning model pruning
Read the original at arxiv.org→arXiv:2609.17890v1 Announce Type: new Abstract: Large reasoning models (LRMs) generate long chain-of-thought traces before answering, creating significant inference overhead. Pruning can reduce this cost, but its...
Original headline: "OBC-Prune: Outcome-Based Calibration for Large Reasoning Model Pruning"
Coverage timeline
- Sep 17, 04:00 UTC arXiv cs.AI lead source OBC-Prune: Outcome-Based Calibration for Large Reasoning Model Pruning