Skip to content

MuST-C

Speech TranslationMulti-Lingual

The MuST-C dataset is a Multi-Lingual speech translation resource from Di Gangi et al. at 2019 comprising 385 Hours examples.

About MuST-C

Dataset is a speech translation corpus containing 385 hours from Ted talks for speech translation from English into several languages: Dutch, French, German, Italian, Portuguese, Romanian, Russian, & Spanish. Requires filling request form.

Details

Task
Speech Translation
Language
Multi-Lingual
Format
n/a
Rows / instances
385 Hours
Creator
Di Gangi et al.
Year
2019
Download Paper

Related Speech Translation datasets

FAQ