MuST-C
Speech TranslationMulti-Lingual
The MuST-C dataset is a Multi-Lingual speech translation resource from Di Gangi et al. at 2019 comprising 385 Hours examples.
About MuST-C
Dataset is a speech translation corpus containing 385 hours from Ted talks for speech translation from English into several languages: Dutch, French, German, Italian, Portuguese, Romanian, Russian, & Spanish. Requires filling request form.
Details
- Task
- Speech Translation
- Language
- Multi-Lingual
- Format
- n/a
- Rows / instances
- 385 Hours
- Creator
- Di Gangi et al.
- Year
- 2019