LibriVoxDeEn: a corpus for German-to-English speech translation and speech recognition

We present a corpus of sentence-aligned triples of German audio, German text, and English translation, based on German audio books. The corpus consists of over 100 hours of audio material and over 50k parallel sentences. The audio data is read speech and thus low in disfluencies. The quality of audi...

Ausführliche Beschreibung

Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Beilharz, Benjamin (Verfasst von) , Sun, Xin (Verfasst von) , Karimova, Sariya (Verfasst von) , Riezler, Stefan (Verfasst von)
Dokumenttyp: Article (Journal) Kapitel/Artikel
Sprache:Englisch
Veröffentlicht: 2019
In: Arxiv

Online-Zugang:Verlag, Volltext: http://arxiv.org/abs/1910.07924
Volltext
Verfasserangaben:Benjamin Beilharz, Xin Sun, Sariya Karimova, Stefan Riezler
Search Result 1

LibriVoxDeEn: a corpus for German-to-English speech translation and speech recognition von Beilharz, Benjamin (Verfasst von) , Sun, Xin (Verfasst von) , Karimova, Sariya (Verfasst von) , Riezler, Stefan (Verfasst von) ,


Volltext
Kapitel/Artikel Konferenzschrift Online Resource
Search Result 2

LibriVoxDeEn: a corpus for German-to-English speech translation and speech recognition von Beilharz, Benjamin (Verfasst von) , Sun, Xin (Verfasst von) ,

Universität 2019-10-21

Volltext
Datenbank Forschungsdaten Online Resource