Sdílení zkušeností v posilovaném učení

but.committeedoc. Ing. František Zbořil, Ph.D. (předseda) doc. RNDr. Dana Hliněná, Ph.D. (místopředseda) doc. Ing. Lukáš Burget, Ph.D. (člen) Ing. František Grézl, Ph.D. (člen) Ing. Josef Strnadel, Ph.D. (člen)cs
but.defenceStudent nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: Máte vysvětlení, proč v Obrázku 6.5 (uprostřed) referenční model v průběhu učení začal získávat mnohem menší odměny? Kolik parametrů měla použitá neuronová síť? Mluvíte nějak v práci o transfer learning? Co bylo výstupem neuronové sítě?cs
but.jazykčeština (Czech)
but.programInformační technologiecs
but.resultpráce byla úspěšně obhájenacs
dc.contributor.advisorHradiš, Michalcs
dc.contributor.authorMojžíš, Radekcs
dc.contributor.refereeŠůstek, Martincs
dc.date.created2019cs
dc.description.abstractCílem této práce je využít metod sdílení zkušeností při učení neuronových sítí na problém posilovaného učení. Jako testovací prostředí používám staré 2D konzolové hry, jako například space invaders nebo Phoenix. Testuji vliv přeučení již natrénovaných modelů na nová podobná prostředí. Dále zkouším metody pro přenášení rysů domén. Nakonec se zaměřuji na možnosti trénování modelu na několika prostředích simultánně. Z výsledků získáme přehled o možnostech sdílení zkušeností při trénování modelů pro algoritmy posilovaného učení.cs
dc.description.abstractThe aim of this thesis is to use methods of transfer learning for training neural network on a reinforcement learning tasks. As test environment, I am  using old 2D console games, such as space invaders or phoenix. I am testing the impact of re-purposing already trained models for different environments. Next I use methods for domain feature transfer. Lastly i focus on the topic of multi-task learning. From the results we can gain insight into possibilities of using transfer learning for reinforcement learning algorithms.en
dc.description.markBcs
dc.identifier.citationMOJŽÍŠ, R. Sdílení zkušeností v posilovaném učení [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2019.cs
dc.identifier.other122286cs
dc.identifier.urihttp://hdl.handle.net/11012/180314
dc.language.isocscs
dc.publisherVysoké učení technické v Brně. Fakulta informačních technologiícs
dc.rightsStandardní licenční smlouva - přístup k plnému textu bez omezenícs
dc.subjectPosilované učenícs
dc.subjectDQNcs
dc.subjectsdílení zkušenostícs
dc.subjectkonvoluční neuronové sítěcs
dc.subjectrozpoznávání obrazucs
dc.subjectstrojové učenícs
dc.subjectumělá inteligencecs
dc.subjectReinforcement learningen
dc.subjectDQNen
dc.subjectTransfer learningen
dc.subjectconvolutional neural networken
dc.subjectimage recognitionen
dc.subjectmachine learningen
dc.subjectartificial Intelligenceen
dc.titleSdílení zkušeností v posilovaném učenícs
dc.title.alternativeShared Experience in Reinforcement Learningen
dc.typeTextcs
dc.type.driverbachelorThesisen
dc.type.evskpbakalářská prácecs
dcterms.dateAccepted2019-06-13cs
dcterms.modified2019-07-08-13:31:37cs
eprints.affiliatedInstitution.facultyFakulta informačních technologiícs
sync.item.dbid122286en
sync.item.dbtypeZPen
sync.item.insts2025.03.18 19:26:44en
sync.item.modts2025.01.15 14:12:22en
thesis.disciplineInformační technologiecs
thesis.grantorVysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédiícs
thesis.levelBakalářskýcs
thesis.nameBc.cs

Files

Original bundle

Now showing 1 - 4 of 4
Loading...
Thumbnail Image
Name:
final-thesis.pdf
Size:
1.39 MB
Format:
Adobe Portable Document Format
Description:
final-thesis.pdf
Loading...
Thumbnail Image
Name:
Posudek-Vedouci prace-22233_v.pdf
Size:
85.74 KB
Format:
Adobe Portable Document Format
Description:
Posudek-Vedouci prace-22233_v.pdf
Loading...
Thumbnail Image
Name:
Posudek-Oponent prace-22233_o.pdf
Size:
88.33 KB
Format:
Adobe Portable Document Format
Description:
Posudek-Oponent prace-22233_o.pdf
Loading...
Thumbnail Image
Name:
review_122286.html
Size:
1.44 KB
Format:
Hypertext Markup Language
Description:
file review_122286.html

Collections