Reverberation Modelling for Robust Speech Recognition in Reverberant Environments

Third party funded individual grant


Project Details

Project leader:
Prof. Dr.-Ing. Walter Kellermann


Contributing FAU Organisations:
Professur für Nachrichtentechnik

Funding source: DFG-Einzelförderung / Sachbeihilfe (EIN-SBH)
Start date: 01/08/2008
End date: 30/08/2011


Abstract (technical / expert description):


Heutige Spracherkennungssysteme erzielen bemerkenswerte Erkennungsraten, wenn Nahbesprechungsmikrofone für die Aufnahme der Sprache verwendet werden. Aufgrund des größeren Abstandes zwischen Sprecher und Mikrofon erschweren im Freisprechbetrieb additive Störungen und der Nachhall des Nutzsignals die Erkennung erheblich. Während in den letzten Jahrzehnten beachtliche Fortschritte hinsichtlich der Robustheit der Erkenner bezüglich additiven Störungen erzielt wurden, bereitet der Nachhall nach wie vor Probleme bei der Erkennung. In diesem Forschungsvorhaben soll ein neuer Ansatz zur robusten Spracherkennung basierend auf der expliziten Modellierung des Nachhalls im Merkmalbereich weiterentwickelt werden. Insbesondere soll der Ansatz für leistungsfähige Sprachmerkmale und leistungsfähige akustische Modelle erweitert und mit in halligen Umgebungen aufgenommenen Sprachdaten anhand komplexer Aufgabenstellungen evaluiert werden.



Last updated on 2018-22-11 at 19:41