Odhad emocí řečníka z mluvené řeči
but.committee | doc. Dr. Ing. Jan Černocký (předseda) prof. Ing. Martin Drahanský, Ph.D. (místopředseda) Ing. Michal Bidlo, Ph.D. (člen) RNDr. Marek Rychlý, Ph.D. (člen) Ing. Michal Španěl, Ph.D. (člen) | cs |
but.defence | Studentka nejprve prezentovala výsledky, kterých dosáhla v rámci své práce. Komise se poté seznámila s hodnocením vedoucího a posudkem oponenta práce. Studentka následně odpověděla na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studentky na položené otázky rozhodla práci hodnotit stupněm výborně (A). Otázky u obhajoby: - Jaké vás napadají jiné možnosti fúze multimodálních skóre s nespolehlivými výstupy (viz zmiňovaný nerozpoznaný obličej ve videu)? - Jaké jsou možné matoucí vlivy pro rozpoznávání (jazyk nahrávky, kanál atp.)? Počítá se s nimi v systému? - Jakým způsobem by se s pomocí vašeho systému mohl realizovat binární detektor jedné emoce, např. smutku? | cs |
but.jazyk | čeština (Czech) | |
but.program | Informační technologie | cs |
but.result | práce byla úspěšně obhájena | cs |
dc.contributor.advisor | Matějka, Pavel | cs |
dc.contributor.author | Popková, Anna | cs |
dc.contributor.referee | Fér, Radek | cs |
dc.date.accessioned | 2020-06-23T09:02:27Z | |
dc.date.available | 2020-06-23T09:02:27Z | |
dc.date.created | 2016 | cs |
dc.description.abstract | Tato bakalářská práce se zabývá výzkumem v oblasti rozpoznávání emocí z řeči a okrajově i z dalších modalit (video a fyziologické záznamy). Popisuje topologii systémů, které byly pro tento výzkum postaveny. Dále popisuje experimenty s těmito systémy vedoucí k optimálnímu předzpracování, trénování a po-zpracování dat. K výzkumu jsou použita data z evaluace AV+EC 2015, do níž byly zaslány výsledky fúzních systému produkujících nejpřesnější predikci. Nově jsou v oblasti rozpoznávání emocí z řeči vyzkoušeny Bottle-Neck příznaky. Jsou použity spolu s běžně používanými eGeMAPS příznaky ve fúzním systému rozpoznávající emoční dimenzi arousal. Emoční dimenze valence je pak rozpoznávána dvojicí video příznaků. Multi-task systém (rozpoznávající valenci i arousal) používající Bottle-Neck příznaky produkuje výslekdy pouze o 13 % relativně horší, než zmíněný fúzní systém, což apeluje hlavně na situace, kde jsou dostupná pouze audio data. | cs |
dc.description.abstract | This Bachelor Thesis deals with research in the field of emotion recognition mainly from speech and marginally from other modalities (video and physiological data). It closely describes the topology of the systems built specifically for the subject of this work. Moreover, it describes experiments leading to optimized pre-processing, regressor training and post-processing. Data used for these research origins from evaluation AV+EC 2015. Results of fusion systems producing the most precise prediction were sent to this evaluation. The Bottle-Neck features are newly tested and combined favorably with commonly used eGeMAPS features for the recognition of arousal. For valence, two kinds of video features are used. Muli-task system (recognizing both valence and arousal) using Bottle-Neck features produces competitive results and is only 13 % relatively behind the mentioned fusion system. This is especially appealing for applications where only audio is available. | en |
dc.description.mark | A | cs |
dc.identifier.citation | POPKOVÁ, A. Odhad emocí řečníka z mluvené řeči [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2016. | cs |
dc.identifier.other | 96478 | cs |
dc.identifier.uri | http://hdl.handle.net/11012/62251 | |
dc.language.iso | cs | cs |
dc.publisher | Vysoké učení technické v Brně. Fakulta informačních technologií | cs |
dc.rights | Standardní licenční smlouva - přístup k plnému textu bez omezení | cs |
dc.subject | Detekce emocí | cs |
dc.subject | audio | cs |
dc.subject | fúze | cs |
dc.subject | kontext | cs |
dc.subject | Bottle-Neck příznaky. | cs |
dc.subject | Emotion recognition | en |
dc.subject | speech | en |
dc.subject | fusion | en |
dc.subject | context | en |
dc.subject | Bottle-Neck features. | en |
dc.title | Odhad emocí řečníka z mluvené řeči | cs |
dc.title.alternative | Emotion Detection from Speech | en |
dc.type | Text | cs |
dc.type.driver | bachelorThesis | en |
dc.type.evskp | bakalářská práce | cs |
dcterms.dateAccepted | 2016-06-15 | cs |
dcterms.modified | 2020-05-10-16:12:36 | cs |
eprints.affiliatedInstitution.faculty | Fakulta informačních technologií | cs |
sync.item.dbid | 96478 | en |
sync.item.dbtype | ZP | en |
sync.item.insts | 2021.11.22 23:59:33 | en |
sync.item.modts | 2021.11.22 23:53:27 | en |
thesis.discipline | Informační technologie | cs |
thesis.grantor | Vysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédií | cs |
thesis.level | Bakalářský | cs |
thesis.name | Bc. | cs |
Files
Original bundle
1 - 4 of 4
Loading...
- Name:
- final-thesis.pdf
- Size:
- 3.46 MB
- Format:
- Adobe Portable Document Format
- Description:
- final-thesis.pdf
Loading...
- Name:
- Posudek-Vedouci prace-18675_v.pdf
- Size:
- 85.62 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Vedouci prace-18675_v.pdf
Loading...
- Name:
- Posudek-Oponent prace-18675_o.pdf
- Size:
- 88.08 KB
- Format:
- Adobe Portable Document Format
- Description:
- Posudek-Oponent prace-18675_o.pdf
Loading...
- Name:
- review_96478.html
- Size:
- 1.43 KB
- Format:
- Hypertext Markup Language
- Description:
- review_96478.html