Skip to content

WikiMatrix

Machine TranslationMulti-Lingual

Created by Schwenk et al. at 2019, the WikiMatrix is a machine translation dataset in Multi-Lingual containing 135 records in TSV format.

About WikiMatrix

Dataset contains 135 million parallel sentences for 1,620 different language pairs in 85 different languages.

Details

Task
Machine Translation
Language
Multi-Lingual
Format
TSV
Rows / instances
135M
Creator
Schwenk et al.
Year
2019
Download Paper

Related Machine Translation datasets

FAQ