Adaptation de ressources en langue anglaise pour interroger des données tabulaires en français (Adaptation of resources in English to query French tabular data)
Les récents développements des approches d’apprentissage neuronal profond ont permis des avancées très significatives dans le domaine de l’interrogation des systèmes d’information en langage naturel. Cependant, pour le français, les ressources à disposition ne permettent de considérer que les requêtes sur des données stockées sous forme de texte. Or, aujourd’hui la majorité des données utilisées en entreprise sont stockées sous forme tabulaire. Il est donc intéressant d’évaluer si les ressources anglophones associées (jeux de données tabulaires et modèles) peuvent être adaptées au français tout en conservant de bons résultats.
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
Traduction automatique de corpus en anglais annot\'es en sens pour la d\'esambigu\"\isation lexicale d'une langue moins bien dot\'ee, l'exemple de l'arabe (Automatic Translation of English Sense Annotated Corpora for Word Sense Disambiguation of a Less Well-endowed Language, the Example of Arabic)
Les corpus annot{\'e}s en sens sont des ressources cruciales pour la t{\^a}che de d{\'e}sambigu{\"\i}sation lexicale (Word Sense Disambiguation). La plupart des langues n{'}en poss{\`e}dent pas ou trop peu pour pouvoir c…
es-enWord Sense DisambiguationCOMFO : Corpus Multilingue pour la Fouille d’Opinions (COMFO: Multilingual Corpus for Opinion Mining)
L’utilisation d’algorithmes de Machine Learning (ML) en fouille d’opinions notamment ceux d’apprentissage supervisé nécessite un corpus annoté pour entrainer le modèle de classification afin de prédire des résultats proc…
Opinion MiningCALOR-QUEST : un corpus d'entra\^\inement et d'\'evaluation pour la compr\'ehension automatique de textes (Machine reading comprehension is a task related to Question-Answering where questions are not generic in scope but are related to a particular document)
La compr{\'e}hension automatique de texte est une t{\^a}che faisant partie de la famille des syst{\`e}mes de Question/R{\'e}ponse o{\`u} les questions ne sont pas {\`a} port{\'e}e g{\'e}n{\'e}rale mais sont li{\'e}es {\`…
Machine Reading ComprehensionQuestion AnsweringReading ComprehensionFine-tuning de modèles de langues pour la veille épidémiologique multilingue avec peu de ressources (Fine-tuning Language Models for Low-resource Multilingual Epidemic Surveillance)
Les modèles de langues pré-entraînés connaissent un très grand succès en TAL, en particulier dans les situations où l’on dispose de suffisamment de données d’entraînement. Cependant, il reste difficile d’obtenir des résu…
Construire des ressources collaboratives pour les langues peu dotées: une modélisation orientée communauté (Building collaborative resources for poorly endowed languages : community-oriented modeling )
Les applications du traitement automatique des langues (TAL) nourrissent aujourd’hui une bonne partie des langues indo-européennes en raison des corpus linguistiques de qualité disponibles en grande quantité et variété. …