Spojování záznamů v genealogických datech
but.committee | doc. RNDr. Pavel Smrž, Ph.D. (předseda) doc. Dr. Ing. Otto Fučík (místopředseda) doc. Mgr. Lukáš Holík, Ph.D. (člen) Ing. Igor Szőke, Ph.D. (člen) Ing. Vladimír Veselý, Ph.D. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: Podle čeho určujete tzv. ground truth a jestli je to součástí vstupního souboru, jak tam poznáte, které záznamy mají být spojeny se kterýma záznamama? Mohl byste úspěšnost vašeho spojování záznamů vyjádřit pomocí true positive, true negative, false positive a false negative, případně pomocí F-measure? Existují již nějaké nástroje? Jak veliká je ground truth? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Zbořil, František | cs |
dc.contributor.author | Šorm, Jan | cs |
dc.contributor.referee | Rozman, Jaroslav | cs |
dc.date.created | 2019 | cs |
dc.description.abstract | Hlavním cílem této bakalářské práce je studium genealogických dat, zjištění možných problému při jejich slučování a implementace metod pro toto slučování dat. V této práci se bude především studovat problematika třídění podobných tvarů jmen do společných tříd. Tento problém se bude studovat zejména proto, že v každém matričním záznamu hrají nejdůležitější roli jména a příjmení dotčených osob a jejich příbuzných. V práci tedy bude rozebráno několik metrik pro výpočet vzdálenosti mezi dvěma řetězci. Dále pak pro tyto metriky bude provedeno několik experimentů, které budou mít za cíl roztřídit jména do tříd s co nejmenším počtem chyb. Na základě těchto výsledků pak budou provedeny i experimenty pro samotné slučování jednotlivých genealogických záznamů. | cs |
dc.description.abstract | The main aim of this thesis is to study genealogical data, to find out possible problems in their merging and to implement methods for this data merging. In this thesis, it will be studied the problem of classifying similar names into common classes. This problem will be studied mainly because people's names and surnames play the most important role in every registry entry. In this thesis, it will be analyzed several metrics for calculating the distance between two strings. In addition, several experiments will be done for these metrics to classify names into classes with as few errors as possible. Based on these results, experiments for record linkage will be performed. | en |
dc.description.mark | B | cs |
dc.identifier.citation | ŠORM, J. Spojování záznamů v genealogických datech [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2019. | cs |
dc.identifier.other | 122189 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/180275 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | genealogie | cs |
dc.subject | matrika | cs |
dc.subject | záznamy | cs |
dc.subject | slučování | cs |
dc.subject | řetězce | cs |
dc.subject | vzdálenosti | cs |
dc.subject | třídy | cs |
dc.subject | C++ | cs |
dc.subject | genealogy | en |
dc.subject | register | en |
dc.subject | records | en |
dc.subject | merging | en |
dc.subject | strings | en |
dc.subject | distances | en |
dc.subject | classes | en |
dc.subject | C++ | en |
dc.title | Spojování záznamů v genealogických datech | cs |
dc.title.alternative | Record Linkage in Genealogical Data | en |
dc.type | Text | cs |
dc.type.driver | bachelorThesis | en |
dc.type.evskp | bakalářská práce | cs |
dcterms.dateAccepted | 2019-06-10 | cs |
dcterms.modified | 2019-07-08-13:31:32 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 122189 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.18 19:26:01 | en |
sync.item.modts | 2025.01.17 13:48:18 | en |
thesis.discipline | Informační technologie | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav inteligentních systémů | cs |
thesis.level | Bakalářský | cs |
thesis.name | Bc. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 718.43 KB
- Format:
- Adobe Portable Document Format
- Description:
- file final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-22057_v.pdf
- Size:
- 85.58 KB
- Format:
- Adobe Portable Document Format
- Description:
- file Posudek-Vedouci prace-22057_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-22057_o.pdf
- Size:
- 88.29 KB
- Format:
- Adobe Portable Document Format
- Description:
- file Posudek-Oponent prace-22057_o.pdf
Loading...
- Name:
- review_122189.html
- Size:
- 1.44 KB
- Format:
- Hypertext Markup Language
- Description:
- file review_122189.html