Sdílení zkušeností v posilovaném učení
| but.committee | doc. Ing. František Zbořil, Ph.D. (předseda) doc. RNDr. Dana Hliněná, Ph.D. (místopředseda) doc. Ing. Lukáš Burget, Ph.D. (člen) Ing. František Grézl, Ph.D. (člen) Ing. Josef Strnadel, Ph.D. (člen) | cs |
| but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: Máte vysvětlení, proč v Obrázku 6.5 (uprostřed) referenční model v průběhu učení začal získávat mnohem menší odměny? Kolik parametrů měla použitá neuronová síť? Mluvíte nějak v práci o transfer learning? Co bylo výstupem neuronové sítě? | cs |
| but.jazyk | čeština (Czech) | |
| but.program | Informační technologie | cs |
| but.result | práce byla úspěšně obhájena | cs |
| dc.contributor.advisor | Hradiš, Michal | cs |
| dc.contributor.author | Mojžíš, Radek | cs |
| dc.contributor.referee | Šůstek, Martin | cs |
| dc.date.created | 2019 | cs |
| dc.description.abstract | Cílem této práce je využít metod sdílení zkušeností při učení neuronových sítí na problém posilovaného učení. Jako testovací prostředí používám staré 2D konzolové hry, jako například space invaders nebo Phoenix. Testuji vliv přeučení již natrénovaných modelů na nová podobná prostředí. Dále zkouším metody pro přenášení rysů domén. Nakonec se zaměřuji na možnosti trénování modelu na několika prostředích simultánně. Z výsledků získáme přehled o možnostech sdílení zkušeností při trénování modelů pro algoritmy posilovaného učení. | cs |
| dc.description.abstract | The aim of this thesis is to use methods of transfer learning for training neural network on a reinforcement learning tasks. As test environment, I am using old 2D console games, such as space invaders or phoenix. I am testing the impact of re-purposing already trained models for different environments. Next I use methods for domain feature transfer. Lastly i focus on the topic of multi-task learning. From the results we can gain insight into possibilities of using transfer learning for reinforcement learning algorithms. | en |
| dc.description.mark | B | cs |
| dc.identifier.citation | MOJŽÍŠ, R. Sdílení zkušeností v posilovaném učení [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2019. | cs |
| dc.identifier.other | 122286 | cs |
| dc.identifier.uri | http://hdl.handle.net/11012/180314 | |
| dc.language.iso | cs | cs |
| dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
| dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
| dc.subject | Posilované učení | cs |
| dc.subject | DQN | cs |
| dc.subject | sdílení zkušeností | cs |
| dc.subject | konvoluční neuronové sítě | cs |
| dc.subject | rozpoznávání obrazu | cs |
| dc.subject | strojové učení | cs |
| dc.subject | umělá inteligence | cs |
| dc.subject | Reinforcement learning | en |
| dc.subject | DQN | en |
| dc.subject | Transfer learning | en |
| dc.subject | convolutional neural network | en |
| dc.subject | image recognition | en |
| dc.subject | machine learning | en |
| dc.subject | artificial Intelligence | en |
| dc.title | Sdílení zkušeností v posilovaném učení | cs |
| dc.title.alternative | Shared Experience in Reinforcement Learning | en |
| dc.type | Text | cs |
| dc.type.driver | bachelorThesis | en |
| dc.type.evskp | bakalářská práce | cs |
| dcterms.dateAccepted | 2019-06-13 | cs |
| dcterms.modified | 2019-07-08-13:31:37 | cs |
| eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
| sync.item.dbid | 122286 | en |
| sync.item.dbtype | ZP | en |
| sync.item.insts | 2025.03.18 19:26:44 | en |
| sync.item.modts | 2025.01.15 14:12:22 | en |
| thesis.discipline | Informační technologie | cs |
| thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
| thesis.level | Bakalářský | cs |
| thesis.name | Bc. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 1.39 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-22233_v.pdf
- Size:
- 85.74 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-22233_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-22233_o.pdf
- Size:
- 88.33 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-22233_o.pdf
Loading...
- Name:
- review_122286.html
- Size:
- 1.44 KB
- Format:
- Hypertext Markup Language
- Description:
- file review_122286.html
