Automatizovaná rekonstrukce webových stránek

but.committeedoc. Dr. Ing. Petr Hanáček (předseda) prof. Ing. Martin Drahanský, Ph.D. (místopředseda) doc. Ing. Radim Burget, Ph.D. (člen) doc. Ing. Vladimír Drábek, CSc. (člen) doc. Mgr. Lukáš Holík, Ph.D. (člen) doc. Ing. Petr Matoušek, Ph.D., M.A. (člen)cs
but.defenceStudent nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm " C ". Otázky u obhajoby: Zásadní pro Vaši práci je použití vhodného renderovacího nástroje. V práci jsem ale nenašel, že byste hledal a porovnával dostupné možnosti. Proč jste zvolil právě Selenium? Uvádíte, že extrakce obsahu, kterou děláte pomocí regulárního výrazu je nepřesná. Jaký jiný přístup by byl vhodnější pro uvažované aplikace?cs
but.jazykčeština (Czech)
but.programInformační technologiecs
but.resultpráce byla úspěšně obhájenacs
dc.contributor.advisorVeselý, Vladimírcs
dc.contributor.authorSerečun, Viliamcs
dc.contributor.refereeRyšavý, Ondřejcs
dc.date.created2018cs
dc.description.abstractMnoho právnych inštitúcií vyžaduje dôkazné bremeno týkajúce sa webového obsahu. Táto diplomová práca sa zaoberá problémom spojeným s automatizáciou webovej rekonštrukcie a webovou archiváciou. Hlavným cieľom je poskytnúť riešenie s s otvoreným zdrojovým kódom , ktoré uspokojí právne inštitúcie s ich požiadavkami. Táto práca predstavuje dva hlavné produkty. Prvý je rámcový program, ktorý je základným stavebným kameňom pre vývoj aplikácií na extrakciu a archiváciu webových stránok. Druhým produktom je prototyp webovej aplikácie. Tento prototyp ukazuje využitie rámcového programu pri riešení požiadavok týchto inštitúcií. Výstupom aplikácie je archív formátu MAFF, ktorý obsahuje zrekonštruovanú webovú stránku, snímku obrazovky webovej stránky a tabuľku meta-informácií. Táto tabuľka zobrazuje informácie o zhromaždených údajoch, informáciách o serveroch, ako sú napríklad IP adresy a porty zariadenia, na ktorom sa nachádzala pôvodná webová stránka, a časové razítko.cs
dc.description.abstractMany legal institutions require a burden of proof regarding web content. This thesis deals with a problem connected to web reconstruction and archiving. The primary goal is to provide an open source solution, which will satisfy legal institutions with their requirements. This work presents two main products. The first is a framework, which is a fundamental building block for developing web scraping and web archiving applications. The second product is a web application prototype. This prototype shows the framework utilization. The application output is MAFF archive file which comprises a reconstructed web page, web page screenshot, and meta information table. This table shows information about collected data, server information such as IP addresses and ports of a device where is the original web page located, and time stamp.en
dc.description.markCcs
dc.identifier.citationSEREČUN, V. Automatizovaná rekonstrukce webových stránek [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2018.cs
dc.identifier.other114844cs
dc.identifier.urihttp://hdl.handle.net/11012/84986
dc.language.isocscs
dc.publisherVysoké učení technické v Brně. Fakulta informačních technologiícs
dc.rightsStandardní licenční smlouva - přístup k plnému textu bez omezenícs
dc.subjectWebová archiváciacs
dc.subjectMozilla Archive Formatcs
dc.subjectExtrakcia webucs
dc.subjectWebová indexáciacs
dc.subjectLemmiwinkscs
dc.subjectMulti-Funkcionálny nástroj na indexáciu a archiváciu webového obsahucs
dc.subjectWeb archivingen
dc.subjectMozilla Archive Formaten
dc.subjectWeb scrapingen
dc.subjectWeb indexingen
dc.subjectLemmiwinksen
dc.subjectMulti-Functional Index Scraping Toolen
dc.titleAutomatizovaná rekonstrukce webových stránekcs
dc.title.alternativeAutomatic Webpage Reconstructionen
dc.typeTextcs
dc.type.drivermasterThesisen
dc.type.evskpdiplomová prácecs
dcterms.dateAccepted2018-06-20cs
dcterms.modified2020-05-10-16:13:26cs
eprints.affiliatedInstitution.facultyFakulta informačních technologiícs
sync.item.dbid114844en
sync.item.dbtypeZPen
sync.item.insts2025.03.26 15:27:52en
sync.item.modts2025.01.15 14:06:35en
thesis.disciplineBezpečnost informačních technologiícs
thesis.grantorVysoké učení technické v Brně. Fakulta informačních technologií. Ústav informačních systémůcs
thesis.levelInženýrskýcs
thesis.nameIng.cs
Files
Original bundle
Now showing 1 - 4 of 4
Loading...
Thumbnail Image
Name:
final-thesis.pdf
Size:
3.36 MB
Format:
Adobe Portable Document Format
Description:
final-thesis.pdf
Loading...
Thumbnail Image
Name:
Posudek-Vedouci prace-21138_v.pdf
Size:
88.81 KB
Format:
Adobe Portable Document Format
Description:
Posudek-Vedouci prace-21138_v.pdf
Loading...
Thumbnail Image
Name:
Posudek-Oponent prace-21138_o.pdf
Size:
90.49 KB
Format:
Adobe Portable Document Format
Description:
Posudek-Oponent prace-21138_o.pdf
Loading...
Thumbnail Image
Name:
review_114844.html
Size:
1.45 KB
Format:
Hypertext Markup Language
Description:
file review_114844.html
Collections