R\'epliquer et \'etendre pour l'alsacien ``\'Etiquetage en parties du discours de langues peu dot\'ees par sp\'ecialisation des plongements lexicaux'' (Replicating and extending for Alsatian : ``POS tagging for low-resource languages by adapting word embeddings'')
Nous pr{\'e}sentons ici les r{\'e}sultats d{'}un travail de r{\'e}plication et d{'}extension pour l{'}alsacien d{'}une exp{\'e}rience concernant l{'}{\'e}tiquetage en parties du discours de langues peu dot{\'e}es par sp{\'e}cialisation des plongements lexicaux (Magistry et al., 2018). Ce travail a {\'e}t{\'e} r{\'e}alis{\'e} en {\'e}troite collaboration avec les auteurs de l{'}article d{'}origine. Cette interaction riche nous a permis de mettre au jour les {\'e}l{\'e}ments manquants dans la pr{\'e}sentation de l{'}exp{\'e}rience, de les compl{\'e}ter, et d{'}{\'e}tendre la recherche {\a} la robustesse {\a} la variation.
Code (0)
등록된 구현이 없습니다.
Tasks
POSPOS TaggingWord EmbeddingsSimilar Papers 제목 키워드 기반
\'Etiquetage en parties du discours de langues peu dot\'ees par sp\'ecialisation des plongements lexicaux (POS tagging for low-resource languages by adapting word embeddings )
Cet article pr{\'e}sente une nouvelle m{\'e}thode d{'}{\'e}tiquetage en parties du discours adapt{\'e}e aux langues peu dot{\'e}es : la d{\'e}finition du contexte utilis{\'e} pour construire les plongements lexicaux est …
POSPOS TaggingWord EmbeddingsTransformation d'annotations en parties du discours et lemmes vers le format Universal Dependencies : \'etude de cas pour l'alsacien et l'occitan (Converting POS-tag and Lemma Annotations into the Universal Dependencies Format : A Case Study on Alsatian and Occitan )
Cet article pr{\'e}sente un retour d{'}exp{\'e}rience sur la transformation de corpus annot{\'e}s pour l{'}alsacien et l{'}occitan vers le format CONLL-U d{\'e}fini dans le projet Universal Dependencies. Il met en partic…
LEMMAPOSTAGVers une solution l\'eg\`ere de production de donn\'ees pour le TAL : cr\'eation d'un tagger de l'alsacien par crowdsourcing b\'en\'evole (Toward a lightweight solution to the language resources bottleneck issue: creating a POS tagger for Alsatian using voluntary crowdsourcing)
Nous pr{\'e}sentons ici les r{\'e}sultats d{'}une exp{\'e}rience men{\'e}e sur l{'}annotation en parties du discours d{'}un corpus d{'}une langue r{\'e}gionale encore peu dot{\'e}e, l{'}alsacien, via une plateforme de my…
POS\'Etiquetage multilingue en parties du discours avec MElt (Multilingual part-of-speech tagging with MElt)
Nous pr{\'e}sentons des travaux r{\'e}cents r{\'e}alis{\'e}s autour de MElt, syst{\`e}me discriminant d{'}{\'e}tiquetage en parties du discours. MElt met l{'}accent sur l{'}exploitation optimale d{'}informations lexicale…
Part-Of-Speech TaggingVers un lexique ouvert des formes fl\'echies de l'alsacien : g\'en\'eration de flexions pour les verbes (Towards an Open Lexicon of Inflected Word Forms for Alsatian: Generation of Verbal Inflection)
Cet article pr{\'e}sente les m{\'e}thodes mises en {\oe}uvre et les r{\'e}sultats obtenus pour la cr{\'e}ation d{'}un lexique de formes fl{\'e}chies de l{'}alsacien. Les dialectes d{'}Alsace font partie des langues peu d…