CVSS
홈페이지 · 논문 26편
CVSS is a massively multilingual-to-English speech to speech translation (S2ST) corpus, covering sentence-level parallel S2ST pairs from 21 languages into English. CVSS is derived from the [Common Voice](common-voice) speech corpus and the [CoVoST](covost) 2 speech-to-text translation (ST) corpus, by synthesizing the translation text from CoVoST 2 into speech using state-of-the-art TTS systems
TextsAudioSpeech EnglishFrenchSpanishGermanItalianChineseJapaneseRussianPortugueseArabicCatalanDutchEstonianIndonesianLatvianPersianSlovenianSwedishTamilTurkishWelshMongolian