Embedding initialization for unseen low-resource languages in multilingual NMT: a case study on Limbum-English translation
Read the original at arxiv.org→arXiv:2608.07629v1 Announce Type: new Abstract: Multilingual neural machine translation models such as NLLB-200 cover 200 languages but leave thousands unsupported, including most Grassfields Bantu languages of...
Original headline: "Embedding Initialization for Unseen Low-resource Languages in Multilingual NMT: A Case Study on Limbum-English Translation"
Coverage timeline
- Aug 11, 04:00 UTC arXiv cs.CL lead source Embedding Initialization for Unseen Low-resource Languages in Multilingual NMT: A Case Study on Limbum-English Translation