Rekurentní neuronové sítě pro rozpoznávání řeči
but.committee | doc. Ing. František Zbořil, CSc. (předseda) prof. Ing. Lukáš Sekanina, Ph.D. (místopředseda) doc. Ing. Michal Bidlo, Ph.D. (člen) Ing. Martin Hrubý, Ph.D. (člen) prof. Ing. Radomil Matoušek, Ph.D. (člen) RNDr. Marek Rychlý, Ph.D. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm dobře (C). Otázky u obhajoby: Rmsprop a grmsprop technika trénování neuronových sítí vám vycházela nejlépe, nicméně v práci je o ní minimum technických informací. Můžete ji popsat a zdůvodnit proč dává dobré výsledky? Jaký je rozdíl v úspěšnosti standardních a CTC systémů? V čem si myslíte, že spočívá problém nestability CTC algoritmu? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Veselý, Karel | cs |
dc.contributor.author | Nováčik, Tomáš | cs |
dc.contributor.referee | Karafiát, Martin | cs |
dc.date.created | 2016 | cs |
dc.description.abstract | Tato diplomová práce se zabývá implementací rekurentních neuronových sítí v prostředí jazyka lua za pomocí knihovny torch. Řeší problematiku trénování rekurentních neuronových sítí a to jak z hlediska optimální trénovací strategie, tak z hlediska urychlení trénovacího procesu. Zkoumá zakomponování technik batch normalizace a dropout do architektur rekurentních neuronových sítí. Jednotlivé typy rekurentních sítí jsou následně porovnány na úkolu rozpoznávání řeči prostřednictvým datové sady AMI, kde slouží pro modelování akustického modelu, a dochází ke srovnání s klasickou dopřednou neuronovou sítí. Nejlepší výsledek je dosažen prostřednictvým rekurentní neuronové sítě BLSTM. Následně dojde k natrénování rekurentních neuronových sítí prostřednictvím objektivní funkce CTC na databázi TIMIT, kde nejlepšího výsledku opět dosáhne BLSTM. | cs |
dc.description.abstract | This master thesis deals with the implementation of various types of recurrent neural networks via programming language lua using torch library. It focuses on finding optimal strategy for training recurrent neural networks and also tries to minimize the duration of the training. Furthermore various types of regularization techniques are investigated and implemented into the recurrent neural network architecture. Implemented recurrent neural networks are compared on the speech recognition task using AMI dataset, where they model the acustic information. Their performance is also compared to standard feedforward neural network. Best results are achieved using BLSTM architecture. The recurrent neural network are also trained via CTC objective function on the TIMIT dataset. Best result is again achieved using BLSTM architecture. | en |
dc.description.mark | C | cs |
dc.identifier.citation | NOVÁČIK, T. Rekurentní neuronové sítě pro rozpoznávání řeči [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2016. | cs |
dc.identifier.other | 96593 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/61863 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | ctc | cs |
dc.subject | irnn | cs |
dc.subject | rnn | cs |
dc.subject | lstm | cs |
dc.subject | gru | cs |
dc.subject | kaldi | cs |
dc.subject | eesen | cs |
dc.subject | rekurentní neuronové sítě | cs |
dc.subject | rozpoznávání řeči | cs |
dc.subject | torch | cs |
dc.subject | paralelní zpracování sekvencí | cs |
dc.subject | akustický model | cs |
dc.subject | batch normalizace | cs |
dc.subject | ami | cs |
dc.subject | timit | cs |
dc.subject | ctc | en |
dc.subject | irnn | en |
dc.subject | rnn | en |
dc.subject | lstm | en |
dc.subject | gru | en |
dc.subject | kaldi | en |
dc.subject | eesen | en |
dc.subject | recurrent neural networks | en |
dc.subject | speech recognition | en |
dc.subject | torch | en |
dc.subject | parallel sequence processing | en |
dc.subject | acustic model | en |
dc.subject | batch normalization | en |
dc.subject | ami | en |
dc.subject | timit | en |
dc.title | Rekurentní neuronové sítě pro rozpoznávání řeči | cs |
dc.title.alternative | Recurrent Neural Networks for Speech Recognition | en |
dc.type | Text | cs |
dc.type.driver | masterThesis | en |
dc.type.evskp | diplomová práce | cs |
dcterms.dateAccepted | 2016-06-21 | cs |
dcterms.modified | 2020-05-10-16:12:44 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 96593 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.26 15:22:13 | en |
sync.item.modts | 2025.01.15 17:17:52 | en |
thesis.discipline | Inteligentní systémy | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Inženýrský | cs |
thesis.name | Ing. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 1.1 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-18910_v.pdf
- Size:
- 86.2 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-18910_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-18910_o.pdf
- Size:
- 96.43 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-18910_o.pdf
Loading...
- Name:
- review_96593.html
- Size:
- 1.45 KB
- Format:
- Hypertext Markup Language
- Description:
- file review_96593.html