Struktury trie pro zpracování rozsáhlých textových dat

Loading...
Thumbnail Image

Date

Authors

Rajčok, Andrej

Mark

B

Journal Title

Journal ISSN

Volume Title

Publisher

Vysoké učení technické v Brně. Fakulta informačních technologií

ORCID

Abstract

Táto práca rozoberá spracovanie prirodzeného jazyka so zameraním sa na morfologickú analýzu a spoznávanie pomenovaných entít. Rozoberá efektívne vyhľadávanie v slovníkoch a v ňom používaných špecializovaných stručných štruktúr a ich praktické implementácie. Popisuje návrh a implementáciu systému pre spoznávanie pomenovaných entít a morfologického analyzátora za využitia stručných štruktúr a nakoniec porovnáva a testuje ich efektivitu a rýchlosť.
This study analyzes natural language processing with emphasis on morphological analysis of inflective languages and systems for named entity recognition. It analyzes effective pattern matching in dictionary by using succint structures and then analyzes practical implementation of succint structures. It describes design and implementation of named entity recognition system and morphological analyzer and compares and test their speed and effectiveness.

Description

Citation

RAJČOK, A. Struktury trie pro zpracování rozsáhlých textových dat [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2016.

Document type

Document version

Date of access to the full text

Language of document

cs

Study field

Inteligentní systémy

Comittee

doc. Ing. František Zbořil, CSc. (předseda) prof. RNDr. Milan Češka, CSc. (místopředseda) Ing. Martin Hrubý, Ph.D. (člen) doc. Ing. Jan Janoušek, Ph.D. (člen) Dr. Ing. Petr Peringer (člen) RNDr. Marek Rychlý, Ph.D. (člen)

Date of acceptance

2016-06-23

Defence

Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: V tabulce 6.6 na straně 49 uvádíte srovnání rychlosti zpracování slov jednotlivými nástroji. Uvedené časy zahrnují také režii potřebnou k načtení slovníku. Můžete komisi ukázat, jak se časy změní, když v nich režie nebude započítána? V tabulce 6.8 na straně 51 uvádíte velikosti binárně reprezentovaných slovníků pro jednotlivé systémy. Pro "nový systém" je velikost slovníku 1,9 GB, ale pro "starý pouhých" 6,3 MB. Čím je tento markantní rozdíl způsoben? Jak to ovlivní použitelnost systému?

Result of defence

práce byla úspěšně obhájena

DOI

Collections

Endorsement

Review

Supplemented By

Referenced By

Citace PRO