Synchronizace textu a audia
but.committee | prof. Dr. Ing. Jan Černocký (předseda) doc. Ing. Jiří Jaroš, Ph.D. (místopředseda) doc. RNDr. Michal Novák, Ph.D. (člen) Ing. Filip Orság, Ph.D. (člen) RNDr. Marek Rychlý, Ph.D. (člen) | cs |
but.defence | Student nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm "C". Otázky u obhajoby: Can simple logistic regression be used over neural networks for G2P score prediction? Did you perform any experiments to compare your G2P alignment approach with existing work (example: section 3.2 landmark phoneme recognizer) ? What are the possible ways to extend or improve this work ? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Szőke, Igor | cs |
dc.contributor.author | Šíma, Tomáš | cs |
dc.contributor.referee | Baskar, Murali Karthick | cs |
dc.date.created | 2018 | cs |
dc.description.abstract | Účelem této práce je průzkum exitujících algoritmů pro synchronizaci textu a audia. Vybrali jsme exitující implementaci jednoho z těchto algoritmů, který je založený na skrytých markovových modelech sdružených sekvencí a prozkoumaly jsme jeho výhody, nevýhody a podivnosti. Dále jsme ověřili, zda je možné předvídat úspěšnost zarovnání z hodnot generovaných Viterbi algoritmem a hodnotou paprsku. Naše testovací data pochází od BBC a byla součástí MGB Challenge 2015. Díky svojí různorodosti poskytují tato data ideální testovací set k ověření flexibility našeho algoritmu a jakožto i jeho schopnosti tolerovat chyby. | cs |
dc.description.abstract | The purpose of this work is to research existing text-to-speech aligning algorithms. We chose an implementation of one these algorithms, based on Hidden-Markov Joint-Sequence Models, and we explored its strengths, quirks and weaknesses. We explored whether it is possible to predict the alignment accuracy using probability values generated from Viterbi algorithm and the beam search value. Our testing data comes from the BBC as part of MGB Challenge 2015. This data creates, with its high content diversity, near perfect testing set to prove our algorithm is flexible and error independent. | en |
dc.description.mark | C | cs |
dc.identifier.citation | ŠÍMA, T. Synchronizace textu a audia [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2018. | cs |
dc.identifier.other | 114780 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/85092 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | Synchronizace textu a audia | cs |
dc.subject | přirozený jazyk | cs |
dc.subject | MGB Challenge | cs |
dc.subject | PhnRec | cs |
dc.subject | G2P | cs |
dc.subject | Viterbi | cs |
dc.subject | Skryté markovovi modely | cs |
dc.subject | Modely sdružených sekvencí | cs |
dc.subject | Text to Audio Alignment | en |
dc.subject | natural language | en |
dc.subject | MGB Challenge | en |
dc.subject | PhnRec | en |
dc.subject | G2P | en |
dc.subject | Viterbi | en |
dc.subject | Hidden Markov Models | en |
dc.subject | Joint-Sequence Models | en |
dc.title | Synchronizace textu a audia | cs |
dc.title.alternative | Text to Audio Alignment | en |
dc.type | Text | cs |
dc.type.driver | bachelorThesis | en |
dc.type.evskp | bakalářská práce | cs |
dcterms.dateAccepted | 2018-06-12 | cs |
dcterms.modified | 2020-05-10-16:13:22 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 114780 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2025.03.18 19:06:06 | en |
sync.item.modts | 2025.01.15 18:56:18 | en |
thesis.discipline | Informační technologie | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Bakalářský | cs |
thesis.name | Bc. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 3.31 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-20997_v.pdf
- Size:
- 86.16 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-20997_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-20997_o.pdf
- Size:
- 86.8 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-20997_o.pdf
Loading...
- Name:
- review_114780.html
- Size:
- 1.42 KB
- Format:
- Hypertext Markup Language
- Description:
- file review_114780.html