Detail práce

Shlukování slov podle významu

Bakalářská práce Student: Hošták Viliam Samuel Akademický rok: 2016/2017 Vedoucí: Smrž Pavel, doc. RNDr., Ph.D.

Název anglicky

Word Sense Clustering

Jazyk práce

český

Abstrakt

Táto práca sa zaoberá sémantickou podobnosťou slov. Popisuje a porovnáva existujúce modely, ktoré sa aktuálne pre tento účel používajú. Rozoberá návrh a implementáciu vytvoreného systému na predspracovanie textového korpusu, vytváranie sémantických modelov a vyhľadávanie sémanticky príbuzných slov. Vytvorený systém umožňuje prácu s distribučnými sémantickými modelmi Word2vec, FastText a GloVe.

Klíčová slova

spracovanie prirodzeného jazyka, sémantická podobnosť, Word2vec, FastText, GloVe, Gensim

Ústav

Ústav počítačové grafiky a multimédií FIT VUT v Brně

Studijní program

Informační technologie

Soubory

Stav

obhájeno, hodnocení A

Obhajoba

14. června 2017

Oponent

Otrusina Lubomír, Ing.

Průběh obhajoby

Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm "A".

Otázky u obhajoby

Při trénování modelů bylo pro každou metodu potřeba nastavit mnoho parametrů. V práci uvádíte, jaké hodnoty jste vybraným parametrům nastavil, ale příliš své rozhodnutí nezdůvodňujete. Můžete shrnout, jaké hodnoty parametrů jste při trénování volil a proč jste nezkoušel i jiné hodnoty?
Jak si vysvětlujete, že model GloVe dosahuje v některých testech podstatně nižší úspěšnosti než Word2Vec a FastText?

Komise

Zbořil František V., doc. Ing., CSc. (UITS FIT VUT), předseda
Burget Lukáš, doc. Ing., Ph.D. (UPGM FIT VUT), člen
Hliněná Dana, doc. RNDr., Ph.D. (UMAT FEKT VUT), člen
Matoušek Petr, doc. Ing., Ph.D., M.A. (UIFS FIT VUT), člen
Zachariášová Marcela, Ing., Ph.D. (UPSY FIT VUT), člen

Citace

HOŠTÁK, Viliam. Shlukování slov podle významu. Brno, 2017. Bakalářská práce. Vysoké učení technické v Brně, Fakulta informačních technologií. 2017-06-14. Vedoucí práce Smrž Pavel. Dostupné z: https://www.fit.vut.cz/study/thesis/14835/

BibTeX

@bachelorsthesis{FITBT14835,
    author = "Samuel Viliam Ho\v{s}t\'{a}k",
    type = "Bakal\'{a}\v{r}sk\'{a} pr\'{a}ce",
    title = "Shlukov\'{a}n\'{i} slov podle v\'{y}znamu",
    school = "Vysok\'{e} u\v{c}en\'{i} technick\'{e} v Brn\v{e}, Fakulta informa\v{c}n\'{i}ch technologi\'{i}",
    year = 2017,
    location = "Brno, CZ",
    language = "czech",
    url = "https://www.fit.vut.cz/study/thesis/14835/"
}

Závěrečné práce