Kdy kdo mluví?

but.committeeprof. Dr. Ing. Pavel Zemčík, dr. h. c. (předseda) prof. RNDr. Milan Češka, CSc. (místopředseda) prof. Ing. Martin Drahanský, Ph.D. (člen) Doc. Ing. Róbert Lórencz, CSc. (člen) RNDr. Marek Rychlý, Ph.D. (člen) doc. Ing. Michal Španěl, Ph.D. (člen)cs
but.defenceStudent nejprve prezentoval výsledky, kterých dosáhl v rámci své práce. Komise se pak seznámila s hodnocením vedoucího a posudkem oponenta práce. Student následně odpověděl na otázky oponenta a na další otázky přítomných. Komise se na základě posudku oponenta, hodnocení vedoucího, přednesené prezentace a odpovědí studenta na položené otázky rozhodla práci hodnotit stupněm A. Otázky u obhajoby: U detekce řečové aktivity používáte pouze energii. Není to přiliš jednoduchá parametrizace. Nezvažoval ste přidání dalších příznaků - počet průchodů nulou, cepstralní koeficienty... Zkoušel ste experimetovat s fonemovým rozpoznávačem, který se tu hojně pro tyto účely používá?cs
but.jazykčeština (Czech)
but.programInformační technologiecs
but.resultpráce byla úspěšně obhájenacs
dc.contributor.advisorMatějka, Pavelcs
dc.contributor.authorTomášek, Pavelcs
dc.contributor.refereeKarafiát, Martincs
dc.date.created2011cs
dc.description.abstractPráce se věnuje implementaci diarizace mluvčího. Popisuje jednotlivé komponenty diarizačního systému, který umí zodpovědět otázku "kdy kdo mluví". Mezi součásti takového systému patří postupně extrakce příznaků vstupních dat, detekce řeči/ticha, segmentace mluvčích, jejich následné shlukování a nakonec i techniky zaměřené na zlepšení finální segmentace. Práce pochopitelně uvádí i dosažené výsledky implementovaného systému na testovací sadě nahrávek včetně popisu způsobu hodnocení. Testovací nahrávky pochází z NIST RT evaluací z let 2005 - 2007 a nejnižší dosažená chybovost na této sadě je 18,52% DER. K porovnání výsledků systému na testovací sadě souborů je zde uvedena i úspěšnost Marijna Huijbregtse z Nizozemí, který v roce 2009 pracoval se stejnými nahrávkami a dosáhl chybovosti 12,91% DER.cs
dc.description.abstractThis work aims at a task of speaker diarization. The goal is to implement a system which is able to decide "who spoke when". Particular components of implementation are described. The main parts are feature extraction, voice activity detection, speaker segmentation and clustering and finally also postprocessing. This work also contains results of implemented system on test data including a description of evaluation. The test data comes from the NIST RT Evaluation 2005 - 2007 and the lowest error rate for this dataset is 18.52% DER. Results are compared with diarization system implemented by Marijn Huijbregts from The Netherlands, who worked on the same data in 2009 and reached 12.91% DER.en
dc.description.markAcs
dc.identifier.citationTOMÁŠEK, P. Kdy kdo mluví? [online]. Brno: Vysoké učení technické v Brně. Fakulta informačních technologií. 2011.cs
dc.identifier.other42396cs
dc.identifier.urihttp://hdl.handle.net/11012/54089
dc.language.isocscs
dc.publisherVysoké učení technické v Brně. Fakulta informačních technologiícs
dc.rightsStandardní licenční smlouva - přístup k plnému textu bez omezenícs
dc.subjectDiarizace mluvčíhocs
dc.subjectsegmentace ticho/řečcs
dc.subjectsegmentace řečics
dc.subjectaglomerativní shlukovánícs
dc.subjectViterbi algoritmuscs
dc.subjectstatistické modelování směsicí gaussovských rozloženícs
dc.subjectSpeaker diarizationen
dc.subjectvoice activity detectionen
dc.subjectspeaker segmentationen
dc.subjectagglomerative clusteringen
dc.subjectViterbi algorithmen
dc.subjectGaussian mixture modelingen
dc.titleKdy kdo mluví?cs
dc.title.alternativeSpeaker Diarizationen
dc.typeTextcs
dc.type.drivermasterThesisen
dc.type.evskpdiplomová prácecs
dcterms.dateAccepted2011-06-23cs
dcterms.modified2020-05-09-23:41:26cs
eprints.affiliatedInstitution.facultyFakulta informačních technologiícs
sync.item.dbid42396en
sync.item.dbtypeZPen
sync.item.insts2025.03.26 14:51:11en
sync.item.modts2025.01.15 16:36:27en
thesis.disciplinePočítačová grafika a multimédiacs
thesis.grantorVysoké učení technické v Brně. Fakulta informačních technologií. Ústav počítačové grafiky a multimédiícs
thesis.levelInženýrskýcs
thesis.nameIng.cs
Files
Original bundle
Now showing 1 - 2 of 2
Loading...
Thumbnail Image
Name:
final-thesis.pdf
Size:
1022.68 KB
Format:
Adobe Portable Document Format
Description:
final-thesis.pdf
Loading...
Thumbnail Image
Name:
review_42396.html
Size:
1.41 KB
Format:
Hypertext Markup Language
Description:
file review_42396.html
Collections