Určování typů entit na základě extrakce informací z Wikipedie
but.committee | doc. Dr. Ing. Dušan Kolář (předseda) doc. Ing. Jaroslav Zendulka, CSc. (místopředseda) Ing. František Grézl, Ph.D. (člen) doc. Ing. Zdeněk Kotásek, CSc. (člen) Dr. Ing. Petr Peringer (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm " C ". Otázky u obhajoby: V kapitole 8 "Výsledky" bych očekával podrobnější srovnání Vašeho systému s DBpedií. Můžete komisi ukázat výsledky tohoto srovnání na několika typech entit. Jaké články správně identifikoval Váš systém oproti DBpedii? Jaké články správně identifikovala DBpedie oproti Vašemu systému? Jaké jsou výhody Vašeho systému oproti DBpedii? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Smrž, Pavel | cs |
dc.contributor.author | Rusiňák, Petr | cs |
dc.contributor.referee | Otrusina, Lubomír | cs |
dc.date.created | 2018 | cs |
dc.description.abstract | Cílem této práce je identifikovat typy článků na Wikipedii (např. rozlišit články o osobách od článků o sportovních utkáních), přičemž tento systém by měl být použitelný pro libovolný typ extrahované entity. Vstupem pro tento systém je seznam několika vzorových článků patřících do hledané entity a seznam několika článků nepatřících do této entity. Na základě těchto seznamů budou vygenerovány příznaky, které lze použít k nalezení všech článků patřící do této entity. Tyto příznaky mohou být založeny jak na základě strukturovaných informací na Wikipedii (např. šablony, kategorie), tak i na základě analýzy přirozeného textu v první větě článku, kde bude nalezeno definiční podstatné jméno vystihující entitu daného článku. Tento systém podporuje extrakci česky a anglicky psaných článků a je rozšířitelný pro podporu dalších jazyků. | cs |
dc.description.abstract | This paper presents a system for identifying entity types of articles on Wikipedia (e.g. people or sports events) that can be used for identifaction of any arbitrary entity. The~input files for this system are a list of several pages that belong to this entity and a list of several pages that do not belong to this entity. These lists will be used to generate features that can be used for generation of the list of all pages belonging to this entity. The fatures can be based on both structured information on Wikipedia such as templates and categories and non-structured informations found by the analysis of natural text in the first sentence of the article where a defining noun that represents what the article is about will be found. This system support pages written in Czech and English and can be extended to support other languages. | en |
dc.description.mark | C | cs |
dc.identifier.citation | RUSIŇÁK, P. Určování typů entit na základě extrakce informací z Wikipedie [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2018. | cs |
dc.identifier.other | 114800 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/85189 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | Wikipedie | cs |
dc.subject | určování typů entit | cs |
dc.subject | asociační analýza | cs |
dc.subject | Wikipedia | en |
dc.subject | identifying entity types | en |
dc.subject | association analysis | en |
dc.title | Určování typů entit na základě extrakce informací z Wikipedie | cs |
dc.title.alternative | Identifying Entity Types Based on Information Extraction from Wikipedia | en |
dc.type | Text | cs |
dc.type.driver | bachelorThesis | en |
dc.type.evskp | bakalářská práce | cs |
dcterms.dateAccepted | 2018-06-14 | cs |
dcterms.modified | 2020-05-10-16:13:23 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 114800 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.18 19:08:03 | en |
sync.item.modts | 2025.01.17 11:26:30 | en |
thesis.discipline | Informační technologie | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Bakalářský | cs |
thesis.name | Bc. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 2.04 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-20995_v.pdf
- Size:
- 86.25 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-20995_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-20995_o.pdf
- Size:
- 89.12 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-20995_o.pdf
Loading...
- Name:
- review_114800.html
- Size:
- 1.46 KB
- Format:
- Hypertext Markup Language
- Description:
- file review_114800.html