Zipbench: low-cost framework for compressing comprehensive benchmarks of large language models
Read the original at arxiv.org→arXiv:2609.12475v1 Announce Type: new Abstract: Comprehensive benchmark suites are essential for improving large language models (LLMs), but many widely used benchmarks are redundant, making evaluation unnecessarily...
Original headline: "Zipbench: Low-Cost Framework for Compressing Comprehensive Benchmarks of Large Language Models"
Coverage timeline
- Sep 14, 04:00 UTC arXiv cs.CL lead source Zipbench: Low-Cost Framework for Compressing Comprehensive Benchmarks of Large Language Models