Remplacement de mentions pour l’adaptation d’un corpus de reconnaissance d’entités nommées à un domaine cible (Mention replacement for adapting a named entity recognition dataset to a target domain)
La reconnaissance d’entités nommées est une tâche de traitement automatique du langage naturel bien étudiée et utile dans de nombreuses applications. Dernièrement, les modèles neuronaux permettent de la résoudre avec de très bonnes performances. Cependant, les jeux de données permettant l’entraînement et l’évaluation de ces modèles se concentrent sur un nombre restreint de domaines et types de documents (articles journalistiques, internet). Or, les performances d’un modèle entraîné sur un domaine ciblé sont en général moindres dans un autre : ceux moins couverts sont donc pénalisés. Pour tenter de remédier à ce problème, cet article propose d’utiliser une technique d’augmentation de données permettant d’adapter un corpus annoté en entités nommées d’un domaine source à un domaine cible où les types de noms rencontrés peuvent être différents. Nous l’appliquons dans le cadre de la littérature de fantasy, où nous montrons qu’elle peut apporter des gains de performance.
Code (0)
등록된 구현이 없습니다.
Tasks
Articlesnamed-entity-recognitionNamed Entity RecognitionNamed Entity Recognition (NER)Similar Papers 제목 키워드 기반
Reconnaissance automatique de la parole : g\'en\'eration des prononciations non natives pour l'enrichissement du lexique (In this study we propose a method for lexicon adaptation in order to improve the automatic speech recognition (ASR) of non-native speakers)
Dans cet article nous proposons une m{\'e}thode d{'}adaptation du lexique, destin{\'e}e {\`a} am{\'e}liorer les syst{\`e}mes de la reconnaissance automatique de la parole (SRAP) des locuteurs non natifs. En effet, la rec…
Automatic Speech RecognitionAutomatic Speech Recognition (ASR)speech-recognitionSpeech RecognitionTraitement des Mots Hors Vocabulaire pour la Traduction Automatique de Document OCRis\'es en Arabe (This article presents a new system that automatically translates images of arabic documents)
Cet article pr{\'e}sente un syst{\`e}me original de traduction de documents num{\'e}ris{\'e}s en arabe. Deux modules sont cascad{\'e}s : un syst{\`e}me de reconnaissance optique de caract{\`e}res (OCR) en arabe et un sys…
es-enOptical Character Recognition (OCR)Stratégies d’adaptation pour la reconnaissance d’entités médicales en français (Adaptation strategies for biomedical named entity recognition in French)
Dans un contexte où peu de corpus annotés pour l’extraction d’entités médicales sont disponibles, nous étudions dans cet article une approche hybride combinant utilisation de connaissances spécialisées et adaptation de m…
named-entity-recognitionNamed Entity RecognitionNamed Entity Recognition (NER)Syst\`eme hybride pour la reconnaissance des entit\'es nomm\'ees arabes \`a base des CRF (Hybrid arabic NER system using CRF Model)
La reconnaissance d{'}entit{\'e}s nomm{\'e}es (REN) pour les langues naturelles telles que l{'}arabe est une t{\^a}che essentielle et difficile. Dans cet article, nous d{\'e}crivons notre syst{\`e}me hybride afin d{'}am{…
NERApports des analyses syntaxiques pour la d\'etection automatique de mentions dans un corpus de fran\ccais oral (Experiences in using deep and shallow parsing to detect entity mentions in oral French)
Cet article pr{\'e}sente trois exp{\'e}riences de d{\'e}tection de mentions dans un corpus de fran{\c{c}}ais oral : ANCOR. Ces exp{\'e}riences utilisent des outils pr{\'e}existants d{'}analyse syntaxique du fran{\c{c}}ai…