Shlukování slov podle významu
but.committee | doc. Ing. František Zbořil, CSc. (předseda) doc. RNDr. Pavel Smrž, Ph.D. (místopředseda) doc. Ing. Jan Kořenek, Ph.D. (člen) Mgr. Ing. Pavel Očenášek, Ph.D. (člen) doc. Ing. František Zbořil, Ph.D. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se pak seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm D (uspokojivě). Otázky u obhajoby: Proč jste zvolil velikost kontextového okna +-1? Testoval jste i jiné velikosti okna? Pokud ano, proč to není v práci zmíněno? U tabulky 5.17 píšete, že nejpodobnější slova ke slovu "indirect" mají dokonce podprůměrnou podobnost. Poměr jejich podobnosti ke slovu "indirect" děleno průměrnou podobností vychází 0,97. Intuitivně by ale na prvních pozicích taková slova vycházet neměla. Můžete komisi objasnit jak počítáte průměrnou podobnost? Proč je tato podobnost pro všechna testovaná slova stejná? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Smrž, Pavel | cs |
dc.contributor.author | Bárta, Jakub | cs |
dc.contributor.referee | Otrusina, Lubomír | cs |
dc.date.created | 2012 | cs |
dc.description.abstract | Tato bakalářská práce se zabývá návrhem a implementací modulárního systému pro analýzu textového korpusu a následné vyhledávání sémanticky podobných slov. Systém umožňuje stemming korpusu, uživatel si může zvolit z různých způsobů analýzy korpus (matice spoluvýskytu, LSA). | cs |
dc.description.abstract | This bachelor's thesis deals with the design and implementation of a modular system focused on semantic similarity. System is able to stem the corpus and to analyze corpus in different ways - through coocurrence matrix or LSA. | en |
dc.description.mark | D | cs |
dc.identifier.citation | BÁRTA, J. Shlukování slov podle významu [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2012. | cs |
dc.identifier.other | 78509 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/55338 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | přirozené zpracování jazyka | cs |
dc.subject | sémantická podobnost | cs |
dc.subject | gensim | cs |
dc.subject | LSA | cs |
dc.subject | matice spoluvýskytu | cs |
dc.subject | natural language processing | en |
dc.subject | semantic similarity | en |
dc.subject | gensim | en |
dc.subject | LSA | en |
dc.subject | coocurrence matrix} | en |
dc.title | Shlukování slov podle významu | cs |
dc.title.alternative | Word Sense Clustering | en |
dc.type | Text | cs |
dc.type.driver | bachelorThesis | en |
dc.type.evskp | bakalářská práce | cs |
dcterms.dateAccepted | 2012-06-12 | cs |
dcterms.modified | 2020-05-09-23:41:49 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 78509 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.18 17:56:35 | en |
sync.item.modts | 2025.01.15 14:48:25 | en |
thesis.discipline | Informační technologie | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Bakalářský | cs |
thesis.name | Bc. | cs |