• čeština
    • English
  • English 
    • čeština
    • English
  • Login
View Item 
  •   Repository Home
  • Závěrečné práce
  • bakalářské práce
  • Fakulta informačních technologií
  • 2018
  • View Item
  •   Repository Home
  • Závěrečné práce
  • bakalářské práce
  • Fakulta informačních technologií
  • 2018
  • View Item
JavaScript is disabled for your browser. Some features of this site may not work without it.

Změření vlivu akustiky prostředí na úspěšnost rozpoznávače řeči

Measurment of Impact of Environment Acoustics on Speech Recognition Accuracy

Thumbnail
View/Open
final-thesis.pdf (3.829Mb)
Posudek-Oponent prace-20272_o.pdf (87.06Kb)
Posudek-Vedouci prace-20272_v.pdf (86.38Kb)
review_114543.html (1.476Kb)
Author
Paliesek, Jakub
Advisor
Szőke, Igor
Referee
Žmolíková, Kateřina
Grade
A
Altmetrics
Metadata
Show full item record
Abstract
Táto bakalárska práca sa venuje sledovaniu vplyvu akustických parametrov na úspešnosť rozpoznávania reči. Použité rozpoznávače sú vyhodnotené na korpusoch Speecon, Temic a LibriSpeech. Porovnávané sú rôzne verzie týchto dát, ktoré vznikli retransmisiou v niekoľkých miestnostiach a umelou retransmisiou pomocou impulzných odoziev. Tie boli vytvorené metódami Exponential sine sweep (ESS) a Maximum length sequence (MLS) pre skutočné miestnosti a tiež pomocou metódy Image source model (ISM), ktorá generuje syntetické impulzné odozvy. Výstupom je porovnanie týchto spôsobov retransmisie. Pre metódu ESS je skúmaná úspešnosť rozpoznávania pre rôzne dĺžky excitačného signálu. Okrem toho je sledovaná závislosť úspešnosti rozpoznávania na vzájomnej polohe zdroja a prijímača, prítomnosti prekážok a smere mikrofónov.
 
This bachelor thesis deals with investigation of impacts of acoustical parameters on automatic speech recognition (ASR) accuracy. Used ASRs were evaluated on Speecon, Temic and LibriSpeech corpuses. This work includes comparison of different versions of these data, which were created using retransmission in several rooms and artificial retransmission using impulse responses. These were created using methods Exponential sine sweep (ESS) and Maximum length sequence (MLS) for real rooms, as well as using Image source model (ISM) method, which generates artificial impulse responses. Output of the thesis is comparison of these types of retransmission. For ESS method, ASR accuracy for different lengths of the excitation signal is examined. Furthermore, the impact of relative position between source and receiver, presence of barriers and directionality of microphones is studied.
 
Keywords
rozpoznávanie reči, akustika, impulzná odozva, exponential sine sweep, speech recognition, acoustics, impulse response, exponential sine sweep
Language
čeština (Czech)
Study brunch
Informační technologie
Composition of Committee
doc. Dr. Ing. Jan Černocký (předseda) doc. Ing. Jiří Jaroš, Ph.D. (místopředseda) doc. RNDr. Michal Novák, Ph.D. (člen) Ing. Filip Orság, Ph.D. (člen) RNDr. Marek Rychlý, Ph.D. (člen)
Date of defence
2018-06-12
Process of defence
Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm "A".
Result of the defence
práce byla úspěšně obhájena
Persistent identifier
http://hdl.handle.net/11012/85195
Source
PALIESEK, J. Změření vlivu akustiky prostředí na úspěšnost rozpoznávače řeči [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2018.
Collections
  • 2018 [277]
Citace PRO

Portal of libraries | Central library on Facebook
DSpace software copyright © 2002-2015  DuraSpace
Contact Us | Send Feedback | Theme by @mire NV
 

 

Browse

All of repositoryCommunities & CollectionsBy Issue DateAuthorsTitlesSubjectsThis CollectionBy Issue DateAuthorsTitlesSubjects

My Account

LoginRegister

Statistics

View Usage Statistics

Portal of libraries | Central library on Facebook
DSpace software copyright © 2002-2015  DuraSpace
Contact Us | Send Feedback | Theme by @mire NV