Identification des Expressions Polylexicales dans les Tweets (Identification of Multiword Expressions in Tweets)
L’identification des expressions polylexicales (EP) dans les tweets est une tâche difficile en raison de la nature linguistique complexe des EP combinée à l’utilisation d’un langage non standard. Dans cet article, nous présentons cette tâche d’identification sur des données anglaises de Twitter. Nous comparons les performances de deux systèmes : un utilisant un dictionnaire et un autre des réseaux de neurones. Nous évaluons expérimentalement sept configurations d’un système état de l’art fondé sur des réseaux neuronaux récurrents utilisant des embeddings contextuels générés par BERT. Le système fondé sur les réseaux neuronaux surpasse l’approche dictionnaire, collecté automatiquement à partir des EP dans des corpus, grâce à son pouvoir de généralisation supérieur.
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
Annotation d'expressions polylexicales verbales en fran\ccais (Annotation of verbal multiword expressions in French)
Nous d{\'e}crivons la partie fran{\c{c}}aise des donn{\'e}es produites dans le cadre de la campagne multilingue PARSEME sur l{'}identification d{'}expressions polylexicales verbales (Savary et al., 2017). Les expressions…
PolylexFLE : une base de donn\'ees d'expressions polylexicales pour le FLE (PolylexFLE : a database of multiword expressions for French L2 language learning)
Nous pr{\'e}sentons la base PolylexFLE, contenant 4295 expressions polylexicales. Elle est integr{\'e}e dans une plateforme d{'}apprentissage du FLE, SimpleApprenant, destin{\'e}e {\`a} l{'}apprentissage des expressions …
D\'emonstrateur en-ligne du projet ANR PARSEME-FR sur les expressions polylexicales (On-line demonstrator of the PARSEME-FR project on multiword expressions)
Nous pr{\'e}sentons le d{\'e}monstrateur en-ligne du projet ANR PARSEME-FR d{\'e}di{\'e} aux expressions polylexicales. Il inclut diff{\'e}rents outils d{'}identification de telles expressions et un outil d{'}exploration…
Expressions polylexicales verbales : \'etude de la variabilit\'e en corpus (Verbal MWEs : a corpus-based study of variability)
La reconnaissance et le traitement appropri{\'e} des expressions polylexicales (EP) constituent un enjeu pour diff{\'e}rentes applications en traitement automatique des langues. Ces expressions sont susceptibles d{'}appa…
ACCOLÉ : Annotation Collaborative d’erreurs de traduction pour COrpus aLignÉs, multi-cibles, et Annotation d’Expressions Poly-lexicales (ACCOLÉ: A Collaborative Platform of Error Annotation for Aligned)
Cette démonstration présente les avancées d’ACCOLÉ (Annotation Collaborative d’erreurs de traduction pour COrpus aLignÉs), qui en plus de proposer une gestion simplifiée des corpus et des typologies d’erreurs, l’annotati…