A two-stage, English-only training method aligns XLM-R representations with Mistral-7B to produce multilingual embeddings, improving low-resource language scores by up to 22 points while losing about 10 points on English.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CL 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
LUSIFER: Language Universal Space Integration for Enhanced Multilingual Embeddings with Large Language Models
A two-stage, English-only training method aligns XLM-R representations with Mistral-7B to produce multilingual embeddings, improving low-resource language scores by up to 22 points while losing about 10 points on English.