Token merging for multilingual speech recognition: a systematic study across model scale and fine-tuning
Read the original at arxiv.org→arXiv:2609.13151v1 Announce Type: new Abstract: Leading multilingual speech recognition models like Whisper transcribe diverse, low-resource languages without language-specific training but are computationally...
Original headline: "Token Merging for Multilingual Speech Recognition: A Systematic Study Across Model Scale and Fine-Tuning"
Coverage timeline
- Sep 15, 04:00 UTC arXiv cs.CL lead source Token Merging for Multilingual Speech Recognition: A Systematic Study Across Model Scale and Fine-Tuning