Classification automatique de questions spontanées vs. préparées dans des transcriptions de l’oral (Automatic Classification of Spontaneous vs)
Ce travail a pour objectif de développer un modèle linguistique pour classifier automatiquement des questions issues de transcriptions d’enregistrements provenant des corpus ESLO2 et ACSYNT en deux catégories “spontané” et “préparé”. Avant de procéder au traitement automatique, nous proposons une liste de critères définitoires et discriminants permettant de distinguer les questions parmi d’autres énoncés. Les expériences basées sur des méthodes d’apprentissage supervisé sont réalisées selon une classification multiclasse comprenant les catégories “spontané”, “préparé” et “non-question” et selon une classification binaire incluant les catégories “spontané” et “préparé” uniquement. Les meilleurs résultats pour les méthodes traditionnelles d’apprentissage automatique sont obtenus avec une régression logistique combinée aux critères linguistiques significatifs uniquement (F-score de 0.75). Pour finir, nous mettons en parallèle ces résultats avec ceux obtenus en utilisant des techniques d’apprentissage profond.
Code (0)
등록된 구현이 없습니다.
Tasks
ClassificationSimilar Papers 제목 키워드 기반
Pr\'edire automatiquement les intentions du locuteur dans des questions issues du discours oral spontan\'e (Automatically predicting the speaker's intentions in questions from spontaneous oral speech)
Cette {\'e}tude porte sur la classification automatique des intentions exprim{\'e}es dans des questions issues d{'}un corpus d{'}{\'e}changes oraux spontan{\'e}s. Nous proposons une typologie dans laquelle nous distinguo…
ClassificationGeneral ClassificationAjout automatique de disfluences pour la synth\`ese de la parole spontan\'ee : formalisation et preuve de concept (Automatic disfluency insertion towards spontaneous TTS : formalization and proof of concept)
Cet article pr{\'e}sente un travail exploratoire sur l{'}ajout automatique de disfluences, c{'}est-{\`a}-dire de pauses, de r{\'e}p{\'e}titions et de r{\'e}visions, dans les {\'e}nonc{\'e}s en entr{\'e}e d{'}un syst{\`e}…
Le corpus PASTEL pour le traitement automatique de cours magistraux (PASTEL corpus for automatic processing of lectures)
Le projet PASTEL {\'e}tudie l{'}acceptabilit{\'e} et l{'}utilisabilit{\'e} des transcriptions automatiques dans le cadre d{'}enseignements magistraux. Il s{'}agit d{'}outiller les apprenants pour enrichir de mani{\`e}re …
D\'etection automatique d'anomalies sur deux styles de parole dysarthrique: parole lue vs spontan\'ee (Automatic anomaly detection for dysarthria across two speech styles : read vs spontaneous speech)
L{'}{\'e}valuation perceptive de la parole pathologique reste le standard dans la pratique clinique pour le diagnostic et le suivi des patients. De telles m{\'e}thodes incluent plusieurs t{\^a}ches telles que la lecture,…
Anomaly DetectionDiagnosticApport de l'adaptation automatique des mod\`eles de langage pour la reconnaissance de la parole: \'evaluation qualitative extrins\`eque dans un contexte de traitement de cours magistraux (Contribution of automatic adaptation of language models for speech recognition : extrinsic qualitative evaluation in a context of educational courses)
Malgr{\'e} les faiblesses connues de cette m{\'e}trique, les performances de diff{\'e}rents syst{\`e}mes de reconnaissance automatique de la parole sont g{\'e}n{\'e}ralement compar{\'e}es {\`a} l{'}aide du taux d{'}erreu…
speech-recognitionSpeech Recognition