Spectral-LSH: sub-quadratic prompt compression via Krylov-projected locality-sensitive hashing
Read the original at arxiv.org→arXiv:2607.19368v1 Announce Type: new Abstract: Long-prompt inference remains expensive because prefill attention scales quadratically with sequence length. We propose Spectral-LSH, a training-free prompt...
Original headline: "Spectral-LSH: Sub-Quadratic Prompt Compression via Krylov-Projected Locality-Sensitive Hashing"
Coverage timeline
- Jul 23, 04:00 UTC arXiv cs.AI lead source Spectral-LSH: Sub-Quadratic Prompt Compression via Krylov-Projected Locality-Sensitive Hashing