arXiv · 1911.03913
Can Monolingual Pretrained Models Help Cross-Lingual Classification?
Abstract
Multilingual pretrained language models (such as multilingual BERT) have achieved impressive results for cross-lingual transfer. However, due to the constant model capacity, multilingual pre-training usually lags behind the monolingual competitors. In this work, we present two approaches to improve zero-shot cross-lingual classification, by transferring the knowledge from monolingual pretrained models to multilingual ones. Experimental results on two cross-lingual classification benchmarks show that our methods outperform vanilla multilingual fine-tuning.
Explore related subjects
Keep this discovery
Explore connections, maps & timelines
Zewen Chi, Li Dong, Furu Wei, Xian-Ling Mao, Heyan Huang. 2019-11-10. Can Monolingual Pretrained Models Help Cross-Lingual Classification?. https://arxiv.org/abs/1911.03913
Cite the original work for its findings. Save a collection to share your selection of sources.