Nízko-dimenzionální faktorizace pro "End-To-End" řečové systémy
but.committee | doc. Dr. Ing. Jan Černocký (předseda) prof. Ing. Adam Herout, Ph.D. (místopředseda) Ing. David Bařina, Ph.D. (člen) Ing. Vítězslav Beran, Ph.D. (člen) Ing. František Grézl, Ph.D. (člen) Ing. Zbyněk Křivka, Ph.D. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm B. Otázky u obhajoby: Můžete uvést čas potřebný pro natrénování sítě TDNN-F+BLSTMP a BLSTMP (tabulka 6.19)? Krátce uveďte rozdíly mezi oběma topologiemi. Pytorch implementace TDNN se dle vašich výsledků trénuje 10x pomaleji než je tomu v Kadi. V čem jsou hlavní důvody tohoto rozdílu? V pytorch implementaci jste použil jinou topologii TDNN(-F) sítě než je topologie v Kaldi. Můžete porovnat výsledky Kadi a pytorch topologie? | cs |
but.jazyk | slovenština (Slovak) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Karafiát, Martin | sk |
dc.contributor.author | Gajdár, Matúš | sk |
dc.contributor.referee | Grézl, František | sk |
dc.date.accessioned | 2020-07-20T19:58:04Z | |
dc.date.available | 2020-07-20T19:58:04Z | |
dc.date.created | 2020 | cs |
dc.description.abstract | Práca sa zaoberá problematikou rozpoznávania reči s pomocou učenia neurónových sietí, na ktoré je aplikovaný algoritmus nízko-dimenzionálnej faktorizácie. V práci je popísaná implementácia časovo oneskorených neurónových sietí s faktorizáciou (TDNN-F) a bez nej (TDNN) v jazyku Pytorch. Následne je porovnávaná s už existujúcou implementáciou v nástroji Kaldi, kde boli dosiahnuté podobné výsledky v rámci experimentovania s rôznymi architektúrami. V poslednej kapitole popisujeme dopad nízko-dimenzionálnej faktorizácie na 'End-to-End' (E2E) rečové systémy a taktiež modifikovanie systému s TDNN(-F) sieťami. Pri experimentoch sa nám v určitých nastaveniach sietí s faktorizáciou podarilo zlepšiť výsledky.Súčasne sme pomocou TDNN(-F) sietí dokázali zmenšiť komplexnosť učenia redukciou veľkosti siete. | sk |
dc.description.abstract | The project covers automatic speech recognition with neural network training using low-dimensional matrix factorization. We are describing time delay neural networks with factorization (TDNN-F) and without it (TDNN) in Pytorch language. We are comparing the implementation between Pytorch and Kaldi toolkit, where we achieve similar results during experiments with various network architectures. The last chapter describes the impact of a low-dimensional matrix factorization on End-to-End speech recognition systems and also a modification of the system with TDNN(-F) networks. Using specific network settings, we were able to achieve better results with systems using factorization. Additionally, we reduced the complexity of training by decreasing network parameters with the use of TDNN(-F) networks. | en |
dc.description.mark | B | cs |
dc.identifier.citation | GAJDÁR, M. Nízko-dimenzionální faktorizace pro "End-To-End" řečové systémy [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2020. | cs |
dc.identifier.other | 129346 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/192526 | |
dc.language.iso | sk | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | Automatické rozpoznávanie reči | sk |
dc.subject | konvolučné neurónové siete | sk |
dc.subject | TDNN | sk |
dc.subject | nízko-dimenzionálna faktorizácia | sk |
dc.subject | E2E | sk |
dc.subject | TDNN-F | sk |
dc.subject | Pytorch | sk |
dc.subject | Kaldi | sk |
dc.subject | ESPnet | sk |
dc.subject | Automatic speech recognition | en |
dc.subject | convolution neural networks | en |
dc.subject | TDNN | en |
dc.subject | low-dimensional matrix factorization | en |
dc.subject | E2E | en |
dc.subject | TDNN-F | en |
dc.subject | Pytorch | en |
dc.subject | Kaldi | en |
dc.subject | ESPnet | en |
dc.title | Nízko-dimenzionální faktorizace pro "End-To-End" řečové systémy | sk |
dc.title.alternative | Low-Dimensional Matrix Factorization in End-To-End Speech Recognition Systems | en |
dc.type | Text | cs |
dc.type.driver | masterThesis | en |
dc.type.evskp | diplomová práce | cs |
dcterms.dateAccepted | 2020-07-15 | cs |
dcterms.modified | 2020-07-17-14:42:11 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 129346 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2021.11.10 14:16:49 | en |
sync.item.modts | 2021.11.10 13:02:26 | en |
thesis.discipline | Počítačová grafika a multimédia | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Inženýrský | cs |
thesis.name | Ing. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 3.29 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Oponent prace-23195_o.pdf
- Size:
- 90.76 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-23195_o.pdf
Loading...
- Name:
- Posudek-Vedouci prace-23195_v.pdf
- Size:
- 85.89 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-23195_v.pdf
Loading...
- Name:
- review_129346.html
- Size:
- 1.47 KB
- Format:
- Hypertext Markup Language
- Description:
- review_129346.html