Heuristiky pro hraní hry Scotland Yard

Cejpek, Michal

Heuristiky pro hraní hry Scotland Yard

Files

final-thesis.pdf (1.25 MB)

review_162128.html (12.18 KB)

Authors

Cejpek, Michal

Advisor

Zbořil, František

Referee

Zbořil, František

Mark

E

Publisher

Vysoké učení technické v Brně. Fakulta informačních technologií

Abstract

Tato práce se zabývá možností použití algoritmů hlubokého a posilovaného učení pro řešení problémů s neúplnou informací. Hlavním zkoumaným algoritmem je PPO – Proximal Policy Optimization (optimalizace proximální politiky). K účelu testování vhodnosti algoritmu PPO byla vytvořena zjednodušená implementace hry Scotland Yard a také prostředí pro trénování a testování algoritmů. Z provedených experimentů této práce vzešlo, že algoritmus PPO je velmi vhodný na řešení problémů s neúplnou informací. Agenti při trénování velmi rychle získali pojem o cílech hry a vybudovali vhodné strategie pro jejich naplnění.
This thesis explores the possibility of using deep and reinforcement learning algorithms to solve problems with incomplete information. The main algorithm studied is PPO – Proximal Policy Optimization. In order to test the suitability of the PPO algorithm, a simplified implementation of the Scotland Yard game was created as well as an environment for training and testing the algorithms. From performed experiments, it emerged that the PPO algorithm is very suitable for solving problems with incomplete information. The agents very quickly gained a sense of the game’s goals and built appropriate strategies to meet those goals through training.

Keywords

DQN , Hry s neurčitostí , Posilované učení , Proximální optimalizace politiky , Scotland Yard , Umělá inteligence ve hrách , Artificial Intelligence , DQN , Games with uncertainty , Proximal Policy Optimization , Reinforcement Learning , Scotland Yard

Citation

CEJPEK, M. Heuristiky pro hraní hry Scotland Yard [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2024.

Language of document

cs

Study field

Informační technologie

Comittee

prof. Ing. Adam Herout, Ph.D. (předseda) prof. Ing. Tomáš Hruška, CSc. (člen) Ing. Tomáš Milet, Ph.D. (člen) doc. Ing. Michal Bidlo, Ph.D. (člen) RNDr. Marek Rychlý, Ph.D. (člen)

Date of acceptance

2024-08-22

Defence

Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm E.

Result of defence

práce byla úspěšně obhájena

URI

http://hdl.handle.net/11012/249556

Collections

2024

Citace PRO

Full item page

Heuristiky pro hraní hry Scotland Yard

Files

Date

Authors

Advisor

Referee

Mark

Journal Title

Journal ISSN

Volume Title

Publisher

ORCID

Abstract

Description

Keywords

Citation

Document type

Document version

Date of access to the full text

Language of document

Study field

Comittee

Date of acceptance

Defence

Result of defence

DOI

URI

Collections

Endorsement

Review

Supplemented By

Referenced By

Citace PRO