Přidávání nových slov v dynamickém dekodéru pro rozpoznávání řeči
Adding New Words in a Dynamic Speech Recognition Decoder

Author
Advisor
Schwarz, PetrReferee
Veselý, KarelGrade
BAltmetrics
Metadata
Show full item recordAbstract
Výstupem této práce je modifikovaný rozpoznávač řeči firmy Phonexia, do kterého je možné za běhu přidávat nová slova, která nejsou obsažena v jeho slovníku. Zvolená implementovaná metoda funguje na principu vkládání konečných automatů s novými slovy přímo do modifikované statické rozpoznávací sítě popisující kombinovaný jazykový a výslovnostní model rozpoznávače na předem připravená místa. Tato metoda poskytuje srovnatelné výsledky s výchozím rozpoznávačem. The result of this thesis is a modified speech recognizer developed by the company Phonexia, in which new words that are not part of its dictionary can be added dynamically. The chosen method that was implemented works by inserting finite automata with new words directly into a modified static recognition network describing combined language and pronunciation model of the recognizer in places that are specified in advance. This method offers comparable results with a speech recognizer without modification.
Keywords
Dekodér, rozpoznávání řeči, OOV, neznámá slova, rozpoznávací síť, HCLG kompozice, Decoder, voice recognition, OOV, unknown words, recognition network, HCLG compositionLanguage
čeština (Czech)Study brunch
Informační technologieComposition of Committee
prof. Dr. Ing. Jan Černocký (předseda) doc. Ing. Jiří Jaroš, Ph.D. (místopředseda) Ing. Vladimír Bartík, Ph.D. (člen) doc. RNDr. Milan Češka, Ph.D. (člen) Ing. Filip Orság, Ph.D. (člen)Date of defence
2022-06-15Process of defence
Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: Jak by se dal zmírnit problém s over-pruningem u metody č.1 ? (beam, vstupní cost, cost na foném) Jak by se dala změnit metoda č.2 v případě použití s monofonním akustickým modelem?Result of the defence
práce byla úspěšně obhájenaPersistent identifier
http://hdl.handle.net/11012/207443Source
ŠKRDLÍK, K. Přidávání nových slov v dynamickém dekodéru pro rozpoznávání řeči [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2022.Collections
- 2022 [309]