Sémantická podobnost článků

but.committeedoc. Dr. Ing. Jan Černocký (předseda) doc. Ing. František Zbořil, CSc. (místopředseda) Ing. Vítězslav Beran, Ph.D. (člen) Ing. Michal Bidlo, Ph.D. (člen) Ing. Karel Masařík, Ph.D. (člen)cs
but.defenceStudent nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: Jakým způsobem jste vybíral dokumenty do Vašeho testovacího korpusu? Jak jste podobnosti těchto dokumentů vyhodnocoval a jak dlouho Vám to trvalo? Můžete prosím komisi objasnit, jak přesně jste implementoval metodu iterativní LSA? Z popisu práce to není příliš jasné.cs
but.jazykčeština (Czech)
but.programInformační technologiecs
but.resultpráce byla úspěšně obhájenacs
dc.contributor.advisorKouřil, Jancs
dc.contributor.authorVeselovský, Martincs
dc.contributor.refereeOtrusina, Lubomírcs
dc.date.accessioned2019-06-14T10:52:18Z
dc.date.available2019-06-14T10:52:18Z
dc.date.created2014cs
dc.description.abstractTato práce se zabývá modelováním struktury sémantických vztahů mezi články v anglickém jazyce. Představuje existující metody pro reprezentaci a výpočet podobnosti článků. Základnou metodou je vektorový model, který reprezentuje dokument jako vektor slov. Jednotlivým slovům jsou v rámci modelu určené váhy důležitosti metodou TF-IDF. Dále jsou zde popsány pokročilé metody modelování a to Latentní sémantická analýza (LSA) a Latentní Dirichletova alokace (LDA). Práce se také zabývá články, které jsou sémanticky anotované, přičemž váhy anotačních slov jsou vypočítány na základe metody SGD. Vyhodnocení výsledků probíhá na připraveném testovacím korpusu dokumentů, ke kterému existuje referenční hodnocení podobnosti.cs
dc.description.abstractThis bachelor's thesis deals with modelling of structure of semantic relationships among articles in English language. There are introduced existing methods of articles representation and computation of similarity. The base method is vector space model, which represents document as vector of words. There are given weights of importance to these words using TF-IDF method. Next, there are described advanced methods of modelling, Latent semantic analysis (LSA) and Latent Dirichlet allocation (LDA). This thesis also deals with articles, which are semantically annotated, while weights of annotation words are computed by Stochastic Gradient Descent method. Evaluation of results takes place on the prepared test corpus of documents to which there is reference similarity evaluation.en
dc.description.markBcs
dc.identifier.citationVESELOVSKÝ, M. Sémantická podobnost článků [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2014.cs
dc.identifier.other79867cs
dc.identifier.urihttp://hdl.handle.net/11012/56420
dc.language.isocscs
dc.publisherVysoké učení technické v Brně. Fakulta informačních technologiícs
dc.rightsStandardní licenční smlouva - přístup k plnému textu bez omezenícs
dc.subjectsémantická podobnostcs
dc.subjectsémantické anotacecs
dc.subjectvektorový modelcs
dc.subjectTF-IDFcs
dc.subjectSGDcs
dc.subjectLSAcs
dc.subjectLDAcs
dc.subjectPythoncs
dc.subjectGensimcs
dc.subjectElasticsearchcs
dc.subjectzpracování přirozeného jazykacs
dc.subjectkřížová validacecs
dc.subjectsemantic similarityen
dc.subjectsemantic annotationsen
dc.subjectvector space modelen
dc.subjectTF-IDFen
dc.subjectSGDen
dc.subjectLSAen
dc.subjectLDAen
dc.subjectPythonen
dc.subjectGensimen
dc.subjectElasticsearchen
dc.subjectnatural language processingen
dc.subjectcross validationen
dc.titleSémantická podobnost článkůcs
dc.title.alternativeSemantic Similarity of Articlesen
dc.typeTextcs
dc.type.driverbachelorThesisen
dc.type.evskpbakalářská prácecs
dcterms.dateAccepted2014-06-18cs
dcterms.modified2020-05-10-16:11:42cs
eprints.affiliatedInstitution.facultyFakulta informačních technologiícs
sync.item.dbid79867en
sync.item.dbtypeZPen
sync.item.insts2021.11.12 22:58:53en
sync.item.modts2021.11.12 21:57:23en
thesis.disciplineInformační technologiecs
thesis.grantorVysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédiícs
thesis.levelBakalářskýcs
thesis.nameBc.cs
Files
Original bundle
Now showing 1 - 2 of 2
Loading...
Thumbnail Image
Name:
final-thesis.pdf
Size:
546.07 KB
Format:
Adobe Portable Document Format
Description:
final-thesis.pdf
Loading...
Thumbnail Image
Name:
review_79867.html
Size:
1.43 KB
Format:
Hypertext Markup Language
Description:
review_79867.html
Collections