Detail práce
Sdílení zkušeností v posilovaném učení
Cílem této práce je využít metod sdílení zkušeností při učení neuronových sítí na problém posilovaného učení. Jako testovací prostředí používám staré 2D konzolové hry, jako například space invaders nebo Phoenix. Testuji vliv přeučení již natrénovaných modelů na nová podobná prostředí. Dále zkouším metody pro přenášení rysů domén. Nakonec se zaměřuji na možnosti trénování modelu na několika prostředích simultánně. Z výsledků získáme přehled o možnostech sdílení zkušeností při trénování modelů pro algoritmy posilovaného učení.
Posilované učení, DQN, sdílení zkušeností, konvoluční neuronové sítě, rozpoznávání obrazu, strojové učení, umělá inteligence
Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B.
- Máte vysvětlení, proč v Obrázku 6.5 (uprostřed) referenční model v průběhu učení začal získávat mnohem menší odměny?
- Kolik parametrů měla použitá neuronová síť?
- Mluvíte nějak v práci o transfer learning?
- Co bylo výstupem neuronové sítě?
Burget Lukáš, doc. Ing., Ph.D. (UPGM FIT VUT), člen
Grézl František, Ing., Ph.D. (UPGM FIT VUT), člen
Hliněná Dana, doc. RNDr., Ph.D. (UMAT FEKT VUT), člen
Strnadel Josef, Ing., Ph.D. (UPSY FIT VUT), člen
@bachelorsthesis{FITBT22233, author = "Radek Moj\v{z}\'{i}\v{s}", type = "Bakal\'{a}\v{r}sk\'{a} pr\'{a}ce", title = "Sd\'{i}len\'{i} zku\v{s}enost\'{i} v posilovan\'{e}m u\v{c}en\'{i}", school = "Vysok\'{e} u\v{c}en\'{i} technick\'{e} v Brn\v{e}, Fakulta informa\v{c}n\'{i}ch technologi\'{i}", year = 2019, location = "Brno, CZ", language = "czech", url = "https://www.fit.vut.cz/study/thesis/22233/" }