Modul Sprachtechnologie
Das Modul umfasst die Vorlesung Sprachtechnologie sowie ein Praktikum und eine Modulprüfung.
Vorlesung Sprachtechnologie
🇩🇪
Im Modul Sprachtechnologie beschäftigen wir uns hauptsächlich mit den Methoden der textgesteuerten Sprachsynthese („Text-to-Speech“) sowie der Spracherkennung („Speech-to-Text“). Wir beginnen mit einer Einführung in die Phonetik, um zunächst den Prozess der Spracherzeugung zu verstehen. Für die Spracherkennung behandeln wir dann Methoden wie die dynamische Zeitverzerrung, Hidden Markov Modelle, sowie vollständig neuronale Erkennermodelle. Für die Sprachsynthese betrachten wir zunächst Methoden der Textvorverarbeitung (z.B. Textnormalisierung) und dann akustische Syntheseverfahren wie die artikulatorische Synthese, Verkettungssynthese und vollständig neuronale Synthese. Im Praktikum lernen Sie die Segmentierung und Annotation von Sprachaudiosignalen kennen und führen Versuche zur Spracherkennung und Synthese mit verschiedenen Methoden durch.
Die Vorlesung kann bei Bedarf auf Englisch gehalten oder durch englischsprachige Unterlagen unterstützt werden.
🇬🇧
In the Speech Technology module, we focus primarily on methods of text-driven speech synthesis (“text-to-speech”) and speech recognition (“speech-to-text”). We begin with an introduction to phonetics to first understand the process of speech production. For speech recognition, we then cover methods such as Dynamic Time Warping, Hidden Markov Models, and fully neural recognition models. For speech synthesis, we will first examine text preprocessing methods (e.g., text normalization) and then acoustic synthesis methods such as articulatory synthesis, concatenative synthesis, and fully neural synthesis. In the lab, you will learn about the segmentation and annotation of speech audio signals and conduct experiments on speech recognition and synthesis using various methods.
If required, the lecture can be held in English or supported by English-language documents.
| Zeit: | Do, 3.DS (11:10 - 12:40 Uhr) |
| Ort: | TOE/0315/U |
| Vortragender: | Prof. Peter Birkholz |
Praktikum
Das Praktikum umfasst Versuche zur Analyse, Erkennung und Synthese von Sprachsignalen.
| Zeit: | Mo., 3. DS (11:10 - 12:40 Uhr) |
| Ort: | BAR/S43 (PC-Pool) |
| Betreuer: | João Menezes |
Modulprüfung
Sobald eine Prüfungsankündigung verfügbar ist, finden Sie diese hier.
Die Modulbeschreibung finden Sie hier. Das Modul ist geeignet für:
| Studiengang | Modulart | Modulname | Modulnummer | Semester |
|---|---|---|---|---|
| Elektrotechnik / Informationstechnik | Wahlpflichtmodul | Sprachtechnologie | EuI-ET-E-SprTe (Profil ASK) | 9 |
| Informationssystemtechnik/ Kommunikationstechnik | Wahlpflichtmodul | Sprachtechnologie |
EuI-IST-E-SprTe |
7 |
Das Modul ist weiterhin geeignet für Studierende anderer technischer Disziplinen.
Empfohlene Kenntnisse: Systemtheorie I und II, Signalverarbeitung, Signalanalyse und Mustererkennung
Modul "Sprachtechnologie" der Professur für Sprachtechnologie und Kognitive Systeme.