Automatizovaná rekonstrukce webových stránek
but.committee | doc. Dr. Ing. Petr Hanáček (předseda) prof. Ing. Martin Drahanský, Ph.D. (místopředseda) doc. Ing. Radim Burget, Ph.D. (člen) doc. Ing. Vladimír Drábek, CSc. (člen) doc. Mgr. Lukáš Holík, Ph.D. (člen) doc. Ing. Petr Matoušek, Ph.D., M.A. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm " C ". Otázky u obhajoby: Zásadní pro Vaši práci je použití vhodného renderovacího nástroje. V práci jsem ale nenašel, že byste hledal a porovnával dostupné možnosti. Proč jste zvolil právě Selenium? Uvádíte, že extrakce obsahu, kterou děláte pomocí regulárního výrazu je nepřesná. Jaký jiný přístup by byl vhodnější pro uvažované aplikace? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Veselý, Vladimír | cs |
dc.contributor.author | Serečun, Viliam | cs |
dc.contributor.referee | Ryšavý, Ondřej | cs |
dc.date.created | 2018 | cs |
dc.description.abstract | Mnoho právnych inštitúcií vyžaduje dôkazné bremeno týkajúce sa webového obsahu. Táto diplomová práca sa zaoberá problémom spojeným s automatizáciou webovej rekonštrukcie a webovou archiváciou. Hlavným cieľom je poskytnúť riešenie s s otvoreným zdrojovým kódom , ktoré uspokojí právne inštitúcie s ich požiadavkami. Táto práca predstavuje dva hlavné produkty. Prvý je rámcový program, ktorý je základným stavebným kameňom pre vývoj aplikácií na extrakciu a archiváciu webových stránok. Druhým produktom je prototyp webovej aplikácie. Tento prototyp ukazuje využitie rámcového programu pri riešení požiadavok týchto inštitúcií. Výstupom aplikácie je archív formátu MAFF, ktorý obsahuje zrekonštruovanú webovú stránku, snímku obrazovky webovej stránky a tabuľku meta-informácií. Táto tabuľka zobrazuje informácie o zhromaždených údajoch, informáciách o serveroch, ako sú napríklad IP adresy a porty zariadenia, na ktorom sa nachádzala pôvodná webová stránka, a časové razítko. | cs |
dc.description.abstract | Many legal institutions require a burden of proof regarding web content. This thesis deals with a problem connected to web reconstruction and archiving. The primary goal is to provide an open source solution, which will satisfy legal institutions with their requirements. This work presents two main products. The first is a framework, which is a fundamental building block for developing web scraping and web archiving applications. The second product is a web application prototype. This prototype shows the framework utilization. The application output is MAFF archive file which comprises a reconstructed web page, web page screenshot, and meta information table. This table shows information about collected data, server information such as IP addresses and ports of a device where is the original web page located, and time stamp. | en |
dc.description.mark | C | cs |
dc.identifier.citation | SEREČUN, V. Automatizovaná rekonstrukce webových stránek [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2018. | cs |
dc.identifier.other | 114844 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/84986 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | Webová archivácia | cs |
dc.subject | Mozilla Archive Format | cs |
dc.subject | Extrakcia webu | cs |
dc.subject | Webová indexácia | cs |
dc.subject | Lemmiwinks | cs |
dc.subject | Multi-Funkcionálny nástroj na indexáciu a archiváciu webového obsahu | cs |
dc.subject | Web archiving | en |
dc.subject | Mozilla Archive Format | en |
dc.subject | Web scraping | en |
dc.subject | Web indexing | en |
dc.subject | Lemmiwinks | en |
dc.subject | Multi-Functional Index Scraping Tool | en |
dc.title | Automatizovaná rekonstrukce webových stránek | cs |
dc.title.alternative | Automatic Webpage Reconstruction | en |
dc.type | Text | cs |
dc.type.driver | masterThesis | en |
dc.type.evskp | diplomová práce | cs |
dcterms.dateAccepted | 2018-06-20 | cs |
dcterms.modified | 2020-05-10-16:13:26 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 114844 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.26 15:27:52 | en |
sync.item.modts | 2025.01.15 14:06:35 | en |
thesis.discipline | Bezpečnost informačních technologií | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav informačních systémů | cs |
thesis.level | Inženýrský | cs |
thesis.name | Ing. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 3.36 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-21138_v.pdf
- Size:
- 88.81 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-21138_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-21138_o.pdf
- Size:
- 90.49 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-21138_o.pdf
Loading...
- Name:
- review_114844.html
- Size:
- 1.45 KB
- Format:
- Hypertext Markup Language
- Description:
- file review_114844.html