• čeština
    • English
    • русский
  • English 
    • čeština
    • English
    • русский
  • Login
View Item 
  •   Repository Home
  • Závěrečné práce
  • bakalářské práce
  • Fakulta informačních technologií
  • 2015
  • View Item
  •   Repository Home
  • Závěrečné práce
  • bakalářské práce
  • Fakulta informačních technologií
  • 2015
  • View Item
JavaScript is disabled for your browser. Some features of this site may not work without it.

Shlukování slov podle významu

Word Sense Clustering

Thumbnail
View/Open
final-thesis.pdf (443.2Kb)
Posudek-Oponent prace-17717_o.pdf (88.60Kb)
Posudek-Vedouci prace-17717_v.pdf (85.42Kb)
review_88731.html (1.426Kb)
Author
Haljuk, Petr
Advisor
Smrž, Pavel
Referee
Otrusina, Lubomír
Grade
C
Altmetrics
Metadata
Show full item record
Abstract
Tato bakalářská práce se zabývá sémantickou podobností slov. Popisuje návrh a implementaci systému, který vyhledává nejpodobnější slova a určuje sémantickou podobnost vět. Systém využívá model Word2Vec z knihovny GenSim . Vztahy mezi slovy se model učí analýzou korpusu CommonCrawl .
 
This Bachelor's thesis deals with the semantic similarity of words . It describes the design and the implementation of a system, which searches for the most similar words and measures the semantic similarity of words . The system uses the Word2Vec model from GenSim library . It learns the relations among words from CommonCrawl corpus .
 
Keywords
zpracování přirozeného jazyka, sémantická podobnost, GenSim, Word2Vec, natural language processing, semantic similarity, GenSim, Word2Vec
Language
čeština (Czech)
Study brunch
Informační technologie
Composition of Committee
doc. Ing. František Zbořil, CSc. (předseda) doc. Ing. Vladimír Drábek, CSc. (místopředseda) doc. Ing. Lukáš Burget, Ph.D. (člen) Ing. Zbyněk Křivka, Ph.D. (člen) doc. Mgr. Adam Rogalewicz, Ph.D. (člen)
Date of defence
2015-06-18
Process of defence
Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm " C ". Otázky u obhajoby: Proč jste zvolil velikost vektoru 300 a velikost kontextového okna 5 pro metodu CBOW, resp. 10 pro Skip-gram? Zkoušel jste s těmito hodnotami nějak experimentovat? Pokud by tyto hodnoty byly vyšší, dosažené výsledky by byly pravděpodobně lepší. Jaké rychlosti jste dosahoval při trénování modelu? Spouštěl jste trénování paralelně? Jaká byla rychlost výpočtu podobných slov?
Result of the defence
práce byla úspěšně obhájena
Persistent identifier
http://hdl.handle.net/11012/52560
Source
HALJUK, P. Shlukování slov podle významu [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2015.
Collections
  • 2015 [295]
Citace PRO

Portal of libraries | Central library on Facebook
DSpace software copyright © 2002-2015  DuraSpace
Contact Us | Send Feedback | Theme by @mire NV
 

 

Browse

All of repositoryCommunities & CollectionsBy Issue DateAuthorsTitlesSubjectsThis CollectionBy Issue DateAuthorsTitlesSubjects

My Account

LoginRegister

Statistics

View Usage Statistics

Portal of libraries | Central library on Facebook
DSpace software copyright © 2002-2015  DuraSpace
Contact Us | Send Feedback | Theme by @mire NV