Apprentissage de plongements lexicaux par une approche r\'eseaux complexes (Complex networks based word embeddings)
La litt{\'e}rature des r{\'e}seaux complexes a montr{\'e} la pertinence de l{'}{\'e}tude de la langue sous forme de r{\'e}seau pour diff{\'e}rentes applications : d{\'e}sambigu{\"\i}sation, r{\'e}sum{\'e} automatique, classification des langues, etc. Cette m{\^e}me litt{\'e}rature a d{\'e}montr{\'e} que les r{\'e}seaux de co-occurrences de mots poss{\e}dent une structure de communaut{\'e}s latente. Nous formulons l{'}hypoth{\e}se que cette structuration du r{\'e}seau sous forme de communaut{\'e}s est utile pour travailler sur la s{\'e}mantique d{'}une langue et introduisons donc dans cet article une m{\'e}thode d{'}apprentissage de plongements originale bas{\'e}e sur cette hypoth{\e}se. Cette hypoth{\e}se est coh{\'e}rente avec la proximit{\'e} qui existe entre la d{\'e}tection de communaut{\'e}s sur un r{\'e}seau de co-occurrences et la factorisation d{'}une matrice de co-occurrences, m{\'e}thode couramment utilis{\'e}e pour l{'}apprentissage de plongements lexicaux. Nous d{\'e}crivons notre m{\'e}thode structur{\'e}e en trois {\'e}tapes : construction et pr{\'e}-traitement du r{\'e}seau, d{\'e}tection de la structure de communaut{\'e}s, construction des plongements de mots {\a} partir de cette structure. Apr{\e}s avoir d{\'e}crit cette nouvelle m{\'e}thodologie, nous montrons la pertinence de notre approche avec des premiers r{\'e}sultats d{'}{\'e}valuation sur les t{\^a}ches de cat{\'e}gorisation et de similarit{\'e}. Enfin, nous discutons des perspectives importantes d{'}un tel mod{\e}le issu des r{\'e}seaux complexes : les dimensions du mod{\e}le (les communaut{\'e}s) semblent interpr{\'e}tables, l{'}apprentissage est rapide, la construction d{'}un nouveau plongement est presque instantan{\'e}e, et il est envisageable d{'}en exp{\'e}rimenter une version incr{\'e}mentale pour travailler sur des corpus textuels temporels.
Code (0)
등록된 구현이 없습니다.
Tasks
Word EmbeddingsSimilar Papers 제목 키워드 기반
Apprentissage de plongements de mots sur des corpus en langue de sp\'ecialit\'e : une \'etude d'impact (Learning word embeddings on domain specific corpora : an impact study )
Les m{\'e}thodes d{'}apprentissage de plongements lexicaux constituent d{\'e}sormais l{'}{\'e}tat de l{'}art pour la repr{\'e}sentation du vocabulaire et des documents sous forme de vecteurs dans de nombreuses t{\^a}ches…
Learning Word EmbeddingsWord EmbeddingsSegmentation de texte non-supervis\'ee pour la d\'etection de th\'ematiques \`a l'aide de plongements lexicaux (Unsupervised text segmentation for topic detection using embeddings )
Cet article pr{\'e}sente les principales m{\'e}thodes de segmentation automatique de documents textuels sp{\'e}cifiques. La t{\^a}che de segmentation th{\'e}matique de texte consiste {\`a} analyser un document pour en ex…
SegmentationSENTERText SegmentationApprentissage de plongements de mots dynamiques avec r\'egularisation de la d\'erive (Learning dynamic word embeddings with drift regularisation)
L{'}usage, le sens et la connotation des mots peuvent changer au cours du temps. Les plongements lexicaux diachroniques permettent de mod{\'e}liser ces changements de mani{\`e}re non supervis{\'e}e. Dans cet article nous…
ArticlesWord EmbeddingsDu bon usage d'ingr\'edients linguistiques sp\'eciaux pour classer des recettes exceptionnelles (Using Special Linguistic Ingredients to Classify Exceptional Recipes )
Nous pr{\'e}sentons un mod{\`e}le d{'}apprentissage automatique qui combine mod{\`e}les neuronaux et linguistiques pour traiter les t{\^a}ches de classification dans lesquelles la distribution des {\'e}tiquettes des inst…
ClassificationGeneral ClassificationWord EmbeddingsAnalyse de sentiments \`a base d'aspects par combinaison de r\'eseaux profonds : application \`a des avis en fran\ccais (A combination of deep learning methods for aspect-based sentiment analysis : application to French reviews)
Cet article propose une approche d{'}analyse de sentiments {\`a} base d{'}aspects dans un texte d{'}opinion. Cette approche se base sur deux {\'e}tapes principales : l{'}extraction d{'}aspects et la classification du sen…
Aspect-Based Sentiment AnalysisAspect-Based Sentiment Analysis (ABSA)General ClassificationSentiment Analysis