LibriVoxDeEn: a corpus for German-to-English speech translation and speech recognition

Abstract: We present a corpus of sentence-aligned triples of German audio, German text, and English translation, based on German audio books. The speech translation data consist of 110 hours of audio material aligned to over 50k parallel sentences. An even larger dataset comprising 547 hours of Germ...

Ausführliche Beschreibung

Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Beilharz, Benjamin (Verfasst von) , Sun, Xin (Verfasst von) , Karimova, Sariya (Verfasst von) , Riezler, Stefan (Verfasst von)
Dokumenttyp: Kapitel/Artikel Konferenzschrift
Sprache:Englisch
Veröffentlicht: 2020
In: LREC 2020 Marseille
Year: 2020, Pages: 3590-3594
Online-Zugang:Verlag, kostenfrei, Volltext: https://aclanthology.org/2020.lrec-1.441
Volltext
Verfasserangaben:Benjamin Beilharz, Xin Sun, Sariya Karimova, Stefan Riezler
Search Result 1

LibriVoxDeEn: a corpus for German-to-English speech translation and speech recognition von Beilharz, Benjamin (Verfasst von) , Sun, Xin (Verfasst von) ,

Universität 2019-10-21

Volltext
Datenbank Forschungsdaten Online Resource
Search Result 2

LibriVoxDeEn: a corpus for German-to-English speech translation and speech recognition von Beilharz, Benjamin (Verfasst von) , Sun, Xin (Verfasst von) , Karimova, Sariya (Verfasst von) , Riezler, Stefan (Verfasst von) ,


Volltext
Article (Journal) Kapitel/Artikel Online Resource