paper-with-me

Papers

Construire des ressources collaboratives pour les langues peu dotées: une modélisation orientée communauté (Building collaborative resources for poorly endowed languages : community-oriented modeling )

2021-06-01 · JEP/TALN/RECITAL 2021 6 · Elvis Mboning, Ornella Wandji

Les applications du traitement automatique des langues (TAL) nourrissent aujourd’hui une bonne partie des langues indo-européennes en raison des corpus linguistiques de qualité disponibles en grande quantité et variété. Les corpus de données open sources en langues africaines étant quasi inexistants, comment arrimer les avancées du TAL à ces langues peu dotées ? Dans cet article, nous examinons le problème de construction des ressources lexicographiques pour les langues peu dotées. Nous souhaitons introduire un modèle de construction des ressources lexicographiques en exploitant les compétences socio-linguistiques des communautés linguistiques locales. Au fil des sections, nous présenterons le nouveau modèle de codification des dictionnaires issue de cette modélisation orientée communauté.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

Simplification automatique de texte dans un contexte de faibles ressources (Automatic Text Simplification : Approaching the Problem in Low Resource Settings for French)

2020-06-01 · JEPTALNRECITAL 2020 6 · Sadaf Abdul Rauf, Anne-Laure Ligozat, Francois Yvon, Gabriel Illouz 외

La simplification de textes a {\'e}merg{\'e} comme un sous-domaine actif du traitement automatique des langues, du fait des probl{\`e}mes pratiques et th{\'e}oriques qu{'}elle permet d{'}aborder, ainsi que de ses nombreu…

Text Simplification

COMFO : Corpus Multilingue pour la Fouille d’Opinions (COMFO: Multilingual Corpus for Opinion Mining)

2022-06-01 · JEP/TALN/RECITAL 2022 6 · Lamine Faty, Khadim Drame, Edouard Ngor Sarr, Marie Ndiaye 외

L’utilisation d’algorithmes de Machine Learning (ML) en fouille d’opinions notamment ceux d’apprentissage supervisé nécessite un corpus annoté pour entrainer le modèle de classification afin de prédire des résultats proc…

Opinion Mining

\'Etiquetage en parties du discours de langues peu dot\'ees par sp\'ecialisation des plongements lexicaux (POS tagging for low-resource languages by adapting word embeddings )

2018-05-01 · JEPTALNRECITAL 2018 5 · Pierre Magistry, Anne-Laure Ligozat, Sophie Rosset

Cet article pr{\'e}sente une nouvelle m{\'e}thode d{'}{\'e}tiquetage en parties du discours adapt{\'e}e aux langues peu dot{\'e}es : la d{\'e}finition du contexte utilis{\'e} pour construire les plongements lexicaux est …

POSPOS TaggingWord Embeddings

Décontextualiser des plongements contextuels pour construire des thésaurus distributionnels (Decontextualizing contextual embeddings for building distributional thesauri )

2022-06-01 · JEP/TALN/RECITAL 2022 6 · Olivier Ferret

Même si les modèles de langue contextuels sont aujourd’hui dominants en traitement automatique des langues, les représentations qu’ils construisent ne sont pas toujours adaptées à toutes les utilisations. Dans cet articl…

Traduction automatique de corpus en anglais annot\'es en sens pour la d\'esambigu\"\isation lexicale d'une langue moins bien dot\'ee, l'exemple de l'arabe (Automatic Translation of English Sense Annotated Corpora for Word Sense Disambiguation of a Less Well-endowed Language, the Example of Arabic)

2018-05-01 · JEPTALNRECITAL 2018 5 · Marwa Hadj Salah, Lo{\"\i}c Vial, Herv{\'e} Blanchon, Mounir Zrigui 외

Les corpus annot{\'e}s en sens sont des ressources cruciales pour la t{\^a}che de d{\'e}sambigu{\"\i}sation lexicale (Word Sense Disambiguation). La plupart des langues n{'}en poss{\`e}dent pas ou trop peu pour pouvoir c…

es-enWord Sense Disambiguation