L'optimisation du plongement de mots pour le fran\ccais : une application de la classification des phrases (Optimization of Word Embeddings for French : an Application of Sentence Classification)
Nous proposons trois nouvelles m{\'e}thodes pour construire et optimiser des plongements de mots pour le fran{\c{c}}ais. Nous utilisons les r{\'e}sultats de l{'}{\'e}tiquetage morpho-syntaxique, de la d{\'e}tection des expressions multi-mots et de la lemmatisation pour un espace vectoriel continu. Pour l{'}{\'e}valuation, nous utilisons ces vecteurs sur une t{\^a}che de classification de phrases et les comparons avec le vecteur du syst{\`e}me de base. Nous explorons {\'e}galement l{'}approche d{'}adaptation de domaine pour construire des vecteurs. Malgr{\'e} un petit nombre de vocabulaires et la petite taille du corpus d{'}apprentissage, les vecteurs sp{\'e}cialis{\'e}s par domaine obtiennent de meilleures performances que les vecteurs hors domaine.
Code (0)
등록된 구현이 없습니다.
Tasks
General ClassificationSentenceSentence ClassificationWord EmbeddingsSimilar Papers 제목 키워드 기반
G\'en\'eration automatique de d\'efinitions pour le fran\ccais (Definition Modeling in French)
La g{\'e}n{\'e}ration de d{\'e}finitions est une t{\^a}che r{\'e}cente qui vise {\`a} produire des d{\'e}finitions lexicographiques {\`a} partir de plongements lexicaux. Nous remarquons deux lacunes : (i) l{'}{\'e}tat de…
L'assimilation de voisement en fran\ccais : elle vaut pour les non-mots autant que les mots (Voice assimilation in French: It applies to nonwords just like to words) [in French]
D\'etection des mots non-standards dans les tweets avec des r\'eseaux de neurones (Detecting non-standard words in tweets with neural networks)
Dans cet article, nous proposons un mod{\`e}le pour d{\'e}tecter dans les textes g{\'e}n{\'e}r{\'e}s par des utilisateurs (en particulier les tweets), les mots non-standards {\`a} corriger. Nous utilisons pour cela des r…
SENTSUtilisation de la translitt\'eration arabe pour l'am\'elioration de l'alignement de mots \`a partir de corpus parall\`eles fran\ccais-arabe (Using Arabic Transliteration to Improve Word Alignment from French-Arabic Parallel Corpora) [in French]
Phon\'etisation statistique adaptable d'\'enonc\'es pour le fran\ccais (Adaptive statistical utterance phonetization for French ⇤ )
Les m{\'e}thodes classiques de phon{\'e}tisation d{'}{\'e}nonc{\'e}s concat{\`e}nent les prononciations hors-contexte des mots. Ce type d{'}approches est trop faible pour certaines langues, comme le fran{\c{c}}ais, o{\`u…