paper-with-me

홈 › Papers

Exploration de param\`etres acoustiques d\'eriv\'es de GMM pour l'adaptation non supervis\'ee de mod\`eles acoustiques \`a base de r\'eseaux de neurones profonds (Exploring GMM-derived features for unsupervised adaptation of deep neural network acoustic models)

2016-07-01 · JEPTALNRECITAL 2016 7 · Natalia Tomashenko, Yuri Khokhlov, Anthony Larcher, Yannick Est{\`e}ve

L{'}{\'e}tude pr{\'e}sent{\'e}e dans cet article am{\'e}liore une m{\'e}thode r{\'e}cemment propos{\'e}e pour l{'}adaptation de mod{\e}les acoustiques markoviens coupl{\'e}s {\a} un r{\'e}seau de neurones profond (DNN-HMM). Cette m{\'e}thode d{'}adaptation utilise des param{\e}tres acoustiques d{\'e}riv{\'e}s de mixtures de mod{\e}les Gaussiens (GMM-derived features, GMMD ). L{'}am{\'e}lioration provient de l{'}emploi de scores et de mesures de confiance calcul{\'e}s {\a} partir de graphes construits dans le cadre d{'}un algorithme d{'}adaptation conventionnel dit de maximum a posteriori (MAP). Une version modifi{\'e}e de l{'}adaptation MAP est appliqu{\'e}e sur le mod{\e}le GMM auxiliaire utilis{\'e} dans une proc{\'e}dure d{'}apprentissage adaptatif au locuteur (speaker adaptative training, SAT) lors de l{'}apprentissage du DNN. Des exp{\'e}riences men{\'e}es sur le corpus Wall Street Journal (WSJ0) montrent que la technique d{'}adaptation non supervis{\'e}e propos{\'e}e dans cet article permet une r{\'e}duction relative de 8, 4{\%} du taux d{'}erreurs sur les mots (WER), par rapport aux r{\'e}sultats obtenus avec des mod{\e}les DNN-HMM ind{\'e}pendants du locuteur utilisant des param{\e}tres acoustiques plus conventionnels.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

C'est ``mm-hm, oui'' ou ``mm-hm, non'' ? Propositions pour une grammaire des composantes acoustiques des interactions nasalis\'ees (A modest proposal for the pragmatic of nasal grunts in the CID corpus)

2020-06-01 · JEPTALNRECITAL 2020 6 · Aur{\'e}lie Chl{\'e}bowski, Nicolas Ballier

Cet article se propose d{'}envisager l{'}existence d{'}une grammaire sp{\'e}cifique aux interactions nasalis{\'e}es (Chl{\'e}bowski et Ballier, 2015). Notre proposition se fonde sur une annotation des composantes acousti…

SENTER

Utilisation des fonctions de croyance pour l'estimation de param\`etres en traduction automatique (Feature calculation for Statistical Machine Translation by using belief functions) [in French]

2012-06-01 · JEPTALNRECITAL 2012 6 · Christophe Servan, Simon Petitrenaud
Machine Translation

Incidence de la chirurgie naso-sinusienne sur la qualit\'e vocale : \'etude d'un cas clinique (Impact of Sinus Surgery on Voice Quality: Case Study)

2016-07-01 · JEPTALNRECITAL 2016 7 · Lise Crevier Buchman, Angelique Amelot, Benedicte Mas, Mathilde Giron 외

Les fosses nasales participent {\`a} la r{\'e}sonance vocale et toute modification de ces structures peut alt{\'e}rer la qualit{\'e} vocale. Le r{\^o}le des sinus comme r{\'e}sonateurs dans la production vocale reste plu…

Effets du sexe et de la langue parl\'ee sur la production de la parole chez les locuteurs cor\'eens et fran\ccais (Effects of sex and language spoken on speech production among Korean and French speakers)

2020-06-01 · JEPTALNRECITAL 2020 6 · Dayeon Yoon, Nicolas Audibert, C{\'e}cile Fougeron

Cette {\'e}tude a pour but d{'}examiner l{'}effet du sexe et de la langue sur la production de la parole lue des locuteurs cor{\'e}ens et fran{\c{c}}ais. Dix param{\`e}tres acoustiques sont utilis{\'e}s pour caract{\'e}r…

Etude de la performance des modèles acoustiques pour des voix de personnes âgées en vue de l'adaptation des systèmes de RAP (Assessment of the acoustic models performance in the ageing voice case for ASR system adaptation) [in French]

2012-06-01 · JEP-TALN-RECITAL 2012 6 · Frédéric Aman, Michel Vacher, Solange Rossato, Remus Dugheanu 외
Automatic Speech RecognitionAutomatic Speech Recognition (ASR)speech-recognitionSpeech Recognition