Pokročilé metody strojového učení pro klasifikaci textu

Loading...
Thumbnail Image
Date
ORCID
Mark
B
Journal Title
Journal ISSN
Volume Title
Publisher
Vysoké učení technické v Brně. Fakulta informačních technologií
Abstract
Tato práce se zabývá pokročilými metodami strojového učení pro klasifikaci textu. Metody jsou nejprve popsány a poté je na základě těchto metod vytvořen systém sloužící pro klasifikaci textových dokumentů. Systém poskytuje také nástroje pro předzpracování dokumentů a hodnocení klasifikátoru. Práce uvádí použití systému na úloze v reálných podmínkách.
This thesis deals with advanced machine-learning methods for text classification. At first, these methods are described, and then text classification system is created based on these methods. The system also provides tools for document preprocessing and evaluation of classifier. The thesis describes the use of the system in a real-life task.
Description
Citation
DOČEKAL, M. Pokročilé metody strojového učení pro klasifikaci textu [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2017.
Document type
Document version
Date of access to the full text
Language of document
cs
Study field
Informační technologie
Comittee
doc. Ing. František Zbořil, CSc. (předseda) doc. Ing. Lukáš Burget, Ph.D. (místopředseda) doc. RNDr. Dana Hliněná, Ph.D. (člen) Ing. Petr Matoušek, Ph.D., M.A. (člen) Ing. Marcela Zachariášová, Ph.D. (člen)
Date of acceptance
2017-06-14
Defence
Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm " B ". Otázky u obhajoby: V práci uvádíte, že výstupy z nástroje Doc2Vec byly klasifikovány pomocí k nejbližších sousedů, pro k rovno 3. Můžete komisi zdůvodnit, proč jste vybral zrovna tuto hodnotu? V práci to nikde uvedeno není. V kapitole 5 uvádíte, že nejhorších výsledků bylo dosaženo za použití nástroje FastText. Máte představu, proč tento nástroj dosahoval tak špatných výsledků v porovnání s dalšími algoritmy?
Result of defence
práce byla úspěšně obhájena
Document licence
Standardní licenční smlouva - přístup k plnému textu bez omezení
DOI
Collections
Citace PRO