Automatická segmentace dokumentů
but.committee | prof. Ing. Martin Drahanský, Ph.D. (předseda) doc. RNDr. Pavel Smrž, Ph.D. (místopředseda) doc. Ing. Jan Kořenek, Ph.D. (člen) doc. Ing. Petr Matoušek, Ph.D., M.A. (člen) doc. Mgr. Adam Rogalewicz, Ph.D. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se pak seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm " A ". Otázky u obhajoby: Vysvětlete význam parametru P (perioda) Gáborova filtru (str. 19), ukažte jeho vliv na tvar filtru. Opravdu ovlivňuje "velikost objektu, na které bude filtr reagovat?" Je běžné aby úspěšnost detekce byla výrazně vyšší na validační datové sadě než na trénovací datové sadě? V kontextu dalších prací na podobné téma, je Vaše úspěšnost 96% dobrá nebo špatná? Považujete vybranou sadu filtrů (globální metrika přes stejnou datovou sadu) za optimální? Uvažoval jste i o jiném způsobu výběru filtrů? Uvažoval jste o možnosti detekce matematických vzorců v dokumentu? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Szőke, Igor | cs |
dc.contributor.author | Jakub, Dušan | cs |
dc.contributor.referee | Španěl, Michal | cs |
dc.date.created | 2012 | cs |
dc.description.abstract | Práce se zabývá rozčleněním dokumentů uložených jako obrázek do segmentů trojího druhu - pozadí, text a grafické objekty. Představuje různé způsoby řešení a podrobněji popisuje postup využívající Gaborovy filtry a neuronové sítě. Je diskutována volba vhodných parametrů filtrů i trénování sítě. Pro zpřesnění výsledků je použita metoda hledání souvislých komponent. Součástí práce je klasifikátor v jazyce C++ vytvořený za použití knihovny OpenCV. Navržený postup byl koncipován pro segmentaci dokumentů publikovaných ve vědeckých časopisech a uložených jako obrázek např. po skenování. Vedle výsledků segmentace odborných textů jsou v práci prezentovány také experimenty se segmentací dokumentů jiného charakteru, např. reklamního letáku a slidů prezentace. V závěru je demonstrován přínos navrženého postupu při zapojení do procesu optického rozpoznávání znaků. | cs |
dc.description.abstract | This work deals with dividing the documents stored as images into three groups of segments - background, text and graphics. It introduces various solutions and the method using Gabor filters and artficial neural networks is described in detail. The selection of apropriate settings of the filters and training parameters of the network is discussed. Connected components searching is used for improving the results. A classifier writen in C++ and OpenCV library is part of the work. The designed procedure is applied for segmentation of scanned scientific papers, but also the results of segmentation of more complex documents (advertisements, presentation slides) are presented. | en |
dc.description.mark | A | cs |
dc.identifier.citation | JAKUB, D. Automatická segmentace dokumentů [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2012. | cs |
dc.identifier.other | 78465 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/55144 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | Segmentace dokumentu | cs |
dc.subject | detekce textu | cs |
dc.subject | texturové příznaky | cs |
dc.subject | Gaborovy filtry | cs |
dc.subject | umělá neuronová síť | cs |
dc.subject | OpenCV | cs |
dc.subject | Document segmentation | en |
dc.subject | text detection | en |
dc.subject | texture analysis | en |
dc.subject | Gabor filters | en |
dc.subject | artificial neural network | en |
dc.subject | OpenCV | en |
dc.title | Automatická segmentace dokumentů | cs |
dc.title.alternative | Automatic Segmentation of Documents Stored as Images | en |
dc.type | Text | cs |
dc.type.driver | bachelorThesis | en |
dc.type.evskp | bakalářská práce | cs |
dcterms.dateAccepted | 2012-06-13 | cs |
dcterms.modified | 2020-05-09-23:40:33 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 78465 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.18 17:53:54 | en |
sync.item.modts | 2025.01.17 09:53:40 | en |
thesis.discipline | Informační technologie | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Bakalářský | cs |
thesis.name | Bc. | cs |