Utilisation d'indices phras\'eologiques pour \'evaluer des textes en langue \'etrang\`ere : comparaison des bigrammes et des trigrammes (Collocation measures and automated scoring of foreign language texts : Comparing bigrams and trigrams)
Cette recherche a pour principal objectif d{'}{\'e}valuer l{'}utilit{\'e} de prendre en compte des mesures totalement automatiques de la comp{\'e}tence phras{\'e}ologique pour estimer la qualit{\'e} de textes d{'}apprenants de l{'}anglais langue {\'e}trang{\e}re. Les analyses, men{\'e}es sur plus de 1000 copies d{'}examen du First Certificate in English, librement mises {\a} disposition par Yannakoudakis et coll., confirment que l{'}approche qui consiste {\a} assigner aux bigrammes et aux trigrammes de mots pr{\'e}sents dans un texte des scores d{'}association collocationnelle calcul{\'e}s sur la base d{'}un grand corpus de r{\'e}f{\'e}rence natif est particuli{\e}rement efficace. Si les indices extraits des trigrammes sont moins efficaces que ceux extraits des bigrammes, ils apportent une contribution utile {\`a} ces derniers. Les analyses soulignent aussi les b{\'e}n{\'e}fices apport{\'e}s par un emploi simultan{\'e} de plusieurs mesures d{'}association collocationnelle.
Code (0)
등록된 구현이 없습니다.
Tasks
SENTSSimilar Papers 제목 키워드 기반
Constituance et phras\'e prosodique en fran\ccais : une \'etude perceptive. (Prosodic constituency and phrasing in French: a perception study)
L{'}objectif de cette {\'e}tude est d{'}explorer l{'}organisation du phras{\'e} prosodique en fran{\c{c}}ais. Il n{'}existe pas de consensus clair sur le nombre de niveaux n{\'e}cessaires pour refl{\'e}ter la hi{\'e}rarc…
Quelles sont les caract\'eristiques des interactions probl\'ematiques entre des utilisateurs et un conseiller virtuel ? (How to characterize problematic interactions between users and a web virtual advisor?)
L{'}utilisation d{'}un conseiller virtuel pour la gestion de la relation client sur les sites des entreprises est une solution num{\'e}rique de plus en plus adopt{\'e}e. Le d{\'e}fi pour les entreprises est de mieux r{\'…
Mesurer la similarit\'e entre phrases gr\^ace \`a Wikip\'edia en utilisant une indexation al\'eatoire
Cet article pr{\'e}sente une m{\'e}thode pour mesurer la similarit{\'e} s{\'e}mantique entre phrases qui utilise Wikip{\'e}dia comme unique ressource linguistique et qui est, de ce fait, utilisable pour un grand nombre d…
Qu'apporte BERT \`a l'analyse syntaxique en constituants discontinus ? Une suite de tests pour \'evaluer les pr\'edictions de structures syntaxiques discontinues en anglais (What does BERT contribute to discontinuous constituency parsing ? A test suite to evaluate discontinuous constituency structure predictions in English)
Cet article propose d{'}analyser les apports d{'}un mod{\`e}le de langue pr{\'e}-entra{\^\i}n{\'e} de type BERT (bidirectional encoder representations from transformers) {\`a} l{'}analyse syntaxique en constituants disco…
Constituency ParsingExploiter des mod\`eles de langue pour \'evaluer des sorties de logiciels d'OCR pour des documents fran\ccais du XVIIe si\`ecle ()
Pour comparer deux sorties de logiciels d{'}OCR, le Character Error Rate (ou, CER) est fr{\'e}quemment utilis{\'e}. Moyennant l{'}existence d{'}une transcription de r{\'e}f{\'e}rence de qualit{\'e} pour certains document…
Optical Character Recognition (OCR)