Analyse de l'effet de la r\'everb\'eration sur la reconnaissance automatique de la parole (Analyzing how reverberation affects Automatic Speech Recognition)
La Reconnaissance Automatique de la Parole (RAP) est moins performante lorsque le signal de parole est de mauvaise qualit{\'e}. Dans cette {\'e}tude, nous analysons les erreurs commises par les syst{\e}mes de RAP lorsque la parole transcrite est r{\'e}verb{\'e}r{\'e}e afin de mieux comprendre les raisons de ces erreurs. Notre analyse permet de mettre en valeur les erreurs dues notamment {\a} un mauvais alignement phon{\'e}tique. Nous avons pu constater que les phon{\e}mes de courte dur{\'e}e sont majoritairement supprim{\'e}s lors du d{\'e}codage phon{\'e}tique. De plus, les phon{\e}mes d{\'e}tect{\'e}s, qu{'}ils soient corrects ou pas, ont tendance {\a} avoir la m{\^e}me dur{\'e}e, ce qui est anormal pour certaines classes phon{\'e}tiques comme les voyelles courtes ou les plosives. Nous avons aussi analys{\'e} les principales confusions entre les diff{\'e}rentes classes phon{\'e}tiques. Finalement, nous avons pu montrer que les erreurs lors de l{'}alignement phon{\'e}tique des syst{\e}mes de transcription automatique entra{\^\i}nent beaucoup d{'}erreurs de d{\'e}tection.
Code (0)
등록된 구현이 없습니다.
Tasks
Automatic Speech RecognitionAutomatic Speech Recognition (ASR)speech-recognitionSpeech RecognitionSimilar Papers 제목 키워드 기반
Reconnaissance automatique de la parole : g\'en\'eration des prononciations non natives pour l'enrichissement du lexique (In this study we propose a method for lexicon adaptation in order to improve the automatic speech recognition (ASR) of non-native speakers)
Dans cet article nous proposons une m{\'e}thode d{'}adaptation du lexique, destin{\'e}e {\`a} am{\'e}liorer les syst{\`e}mes de la reconnaissance automatique de la parole (SRAP) des locuteurs non natifs. En effet, la rec…
Automatic Speech RecognitionAutomatic Speech Recognition (ASR)speech-recognitionSpeech RecognitionAnalyse d'erreurs de transcriptions phon\'emiques automatiques d'une langue « rare » : le na (mosuo) (Analyzing errors in automatic phonemic transcriptions of the Na (Mosuo) language (SinoTibetan family) Automatic phonemic transcription tools now reach high levels of accuracy on a single speaker with relatively small amounts of training data: on the order two to three hours of transcribed speech)
Les syst{\`e}mes de reconnaissance automatique de la parole atteignent d{\'e}sormais des degr{\'e}s de pr{\'e}cision {\'e}lev{\'e}s sur la base d{'}un corpus d{'}entra{\^\i}nement limit{\'e} {\`a} deux ou trois heures d{…
Analyse de sentiments des vid\'eos en dialecte alg\'erien (Sentiment analysis of videos in Algerian dialect)
La plupart des travaux existant sur l{'}analyse de sentiments traitent l{'}arabe standard moderne et ne prennent pas en consid{\'e}ration les sp{\'e}cificit{\'e}s de l{'}arabe dialectal. Cet article pr{\'e}sente un syst{…
es-enSentiment AnalysisReconnaissance d’entités nommées sur des sorties OCR bruitées : des pistes pour la désambiguïsation morphologique automatique (Resolution of entity linking issues on noisy OCR output : automatic disambiguation tracks)
La variation dans les données textuelles, en particulier le bruit, est un facteur limitant la performance des systèmes de Reconnaissance d’Entités Nommées (REN). Les systèmes de REN sont en effet généralement entraînés s…
Entity LinkingOptical Character Recognition (OCR)Mesures linguistiques automatiques pour l’évaluation des systèmes de Reconnaissance Automatique de la Parole (Automated linguistic measures for automatic speech recognition systems’ evaluation)
L’évaluation de transcriptions issues de systèmes de Reconnaissance Automatique de la Parole (RAP) est un problème difficile et toujours ouvert, qui se résume généralement à ne considérer que le WER. Nous présentons dans…
Automatic Speech RecognitionAutomatic Speech Recognition (ASR)speech-recognitionSpeech Recognition