hLLM: Single Pass Decoding for Generative Reranking
Read the original at arxiv.org→arXiv:2609.01807v1 Announce Type: new Abstract: Large language models (LLMs) achieve state-of-the-art generative ranking quality, but the ranking they produce must be decoded, and autoregressive decoding spends one...
Coverage timeline
- Sep 3, 04:00 UTC arXiv cs.LG lead source hLLM: Single Pass Decoding for Generative Reranking