Klasifikace typů stran dokumentu
| but.committee | prof. Ing. Adam Herout, Ph.D. (předseda) Ing. Vladimír Bartík, Ph.D. (člen) Ing. Michal Hradiš, Ph.D. (člen) Ing. Josef Strnadel, Ph.D. (člen) doc. Mgr. Adam Rogalewicz, Ph.D. (člen) | cs |
| but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. | cs |
| but.jazyk | čeština (Czech) | |
| but.program | Informační technologie | cs |
| but.result | práce byla úspěšně obhájena | cs |
| dc.contributor.advisor | Kohút, Jan | cs |
| dc.contributor.author | Šmida, Matěj | cs |
| dc.contributor.referee | Beran, Vítězslav | cs |
| dc.date.created | 2025 | cs |
| dc.description.abstract | Tato diplomová práce se zabývá se zabývá problémem automatické klasifikace stran v dokumentech, což je jeden z klíčových bodů v oblasti analýzy a zpracování dokumentů, jako je extrakce informací nebo digitální archivace. Práce se zaměřuje na metody hlubokého učení a zejména na architektury založené na vizuálních transformerech, jako je Vision Transformer (ViT model). Speciální pozornost je věnována multimodálnímu přístupu, který kombinuje vizuální informace z obrazu a extrahovaná textová data dokumentu a modelu CLIP, který jsem upravil pro klasifikaci a experimentoval s ním. | cs |
| dc.description.abstract | This thesis deals with the problem of automatic classification of pages in documents, which is one of the key issues in document analysis and processing, such as information extraction or digital archiving. The thesis focuses on deep learning methods and in particular on architectures based on visual transformers, such as the Vision Transformer (ViT model). Special attention is paid to a multimodal approach that combines visual information from an image and extracted text data from a document, and to the CLIP model that I have adapted for classification and experimented with. | en |
| dc.description.mark | B | cs |
| dc.identifier.citation | ŠMIDA, M. Klasifikace typů stran dokumentu [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2025. | cs |
| dc.identifier.other | 164607 | cs |
| dc.identifier.uri | http://hdl.handle.net/11012/252812 | |
| dc.language.iso | cs | cs |
| dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
| dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
| dc.subject | klasifikace dokumentu | cs |
| dc.subject | zpracování obrazu | cs |
| dc.subject | analýza dokumentů | cs |
| dc.subject | počítačové vidění | cs |
| dc.subject | strojové učení | cs |
| dc.subject | Vision Transformer (ViT) | cs |
| dc.subject | CLIP (Contrastive Language–Image Pre-training) | cs |
| dc.subject | multimodální učení | cs |
| dc.subject | document classification | en |
| dc.subject | image processing | en |
| dc.subject | document analysis | en |
| dc.subject | computer vision | en |
| dc.subject | machine learning | en |
| dc.subject | Vision Transformer (ViT) | en |
| dc.subject | CLIP (Contrastive Language–Image Pre-training) | en |
| dc.subject | multimodal learning | en |
| dc.title | Klasifikace typů stran dokumentu | cs |
| dc.title.alternative | Document Page Type Classification | en |
| dc.type | Text | cs |
| dc.type.driver | bachelorThesis | en |
| dc.type.evskp | bakalářská práce | cs |
| dcterms.dateAccepted | 2025-06-16 | cs |
| dcterms.modified | 2025-06-16-15:20:04 | cs |
| eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
| sync.item.dbid | 164607 | en |
| sync.item.dbtype | ZP | en |
| sync.item.insts | 2025.08.26 23:03:55 | en |
| sync.item.modts | 2025.08.26 19:47:49 | en |
| thesis.discipline | Informační technologie | cs |
| thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
| thesis.level | Bakalářský | cs |
| thesis.name | Bc. | cs |
