Batch-wise adaptive pruning applies a single activation-aware pruning mask across batches to language reasoning models, enabling periodic neuron activation-guided weight pruning without training.
Read the original at arxiv.org→arXiv:2608.14003v1 Announce Type: new Abstract: Large Reasoning Models (LRMs) achieve strong performance on complex tasks through extended chain-of-thought generation, but incur substantial computational costs...
Original headline: "Batch-wise Adaptive Pruning: Periodic Neuron Activation-Aware Weight Pruning for Language Reasoning Model"
Coverage timeline
- Aug 17, 04:00 UTC arXiv cs.CL lead source Batch-wise Adaptive Pruning: Periodic Neuron Activation-Aware Weight Pruning for Language Reasoning Model
- Aug 17, 04:00 UTC arXiv cs.LG Training-Free Knowledge Transfer Across Model Scales through Activation-Guided Pruning