Depth-Aware sensitivity analysis of mixture-of-experts models via magnitude-based expert masking
Read the original at arxiv.org→arXiv:2608.13565v1 Announce Type: new Abstract: Mixture-of-Experts (MoE) architectures scale large language models (LLMs) while preserving computational efficiency through sparse activation. Despite their widespread...
Original headline: "Depth-Aware Sensitivity Analysis of Mixture-of-Experts Models via Magnitude-Based Expert Masking"
Coverage timeline
- Aug 17, 04:00 UTC arXiv cs.AI lead source Depth-Aware Sensitivity Analysis of Mixture-of-Experts Models via Magnitude-Based Expert Masking