D\'ecouverte de nouvelles entit\'es et relations spatiales \`a partir d'un corpus de SMS (Discovering of new Spatial Entities and Relations from SMS Within the context of the currently available data masses, many works related to the analysis of spatial information are based on the exploitation of textual data)
Dans le contexte des masses de donn{\'e}es aujourd{'}hui disponibles, de nombreux travaux li{\'e}s {\a} l{'}analyse de l{'}information spatiale s{'}appuient sur l{'}exploitation des donn{\'e}es textuelles. La communication m{\'e}di{\'e}e (SMS, tweets, etc.) v{\'e}hiculant des informations spatiales prend une place pr{\'e}pond{\'e}rante. L{'}objectif du travail pr{\'e}sent{\'e} dans cet article consiste {\a} extraire ces informations spatiales {\a} partir d{'}un corpus authentique de SMS en fran{\c{c}}ais. Nous proposons un processus dans lequel, dans un premier temps, nous extrayons de nouvelles entit{\'e}s spatiales (par exemple, motpellier, montpeul {\a} associer au toponyme Montpellier). Dans un second temps, nous identifions de nouvelles relations spatiales qui pr{\'e}c{\e}dent les entit{\'e}s spatiales (par exemple, sur, par, pres, etc.). La t{\^a}che est difficile et complexe en raison de la sp{\'e}cificit{\'e} du langage SMS qui repose sur une {\'e}criture peu standardis{\'e}e (apparition de nombreux lexiques, utilisation massive d{'}abr{\'e}viations, variation par rapport {\a} l{'}{\'e}crit classique, etc.). Les exp{\'e}rimentations qui ont {\'e}t{\'e} r{\'e}alis{\'e}es {\a} partir du corpus 88milSMS mettent en relief la robustesse de notre syst{\e}me pour identifier de nouvelles entit{\'e}s et relations spatiales.
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
De l'extraction des interactions m\'edicament-m\'edicament vers les interactions aliment-m\'edicament \`a partir de textes biom\'edicaux: Adaptation de domaine (From the extraction of drug-drug interactions to the food-drug interactions in biomedical texts : domain adaptation)
Les interactions aliments-m{\'e}dicaments (FDI) se produisent lorsque des aliments et des m{\'e}dicaments sont pris simultan{\'e}ment et provoquent un effet inattendu. Nous consid{\'e}rons l{'}extraction de ces interacti…
Domain AdaptationRelationClassification de relations pour l'intelligence \'economique et concurrentielle (Relation Classification for Competitive and Economic Intelligence )
L{'}extraction de relations reliant des entit{\'e}s par des liens s{\'e}mantiques {\`a} partir de texte a fait l{'}objet de nombreux travaux visant {\`a} extraire des relations g{\'e}n{\'e}riques comme l{'}hyperonymie ou…
ClassificationGeneral ClassificationRelationRelation ClassificationConstruction de patrons lexico-syntaxiques d'extraction pour l'acquisition de connaissances \`a partir du web (Relation pattern extraction and information extraction from the web)
Cet article pr{\'e}sente une m{\'e}thode permettant de collecter sur le web des informations compl{\'e}mentaires {\`a} une information pr{\'e}d{\'e}finie, afin de remplir une base de connaissances. Notre m{\'e}thode util…
Participation d’EDF R&D à DEFT 2021 (EDF R&D Participation to DEFT 2021)
Ce papier présente la participation d’EDF R&D à la campagne d’évaluation DEFT 2021. Notre équipe a participé aux deux dernières tâches proposées (T2 et T3), deux tâches sur le calcul de similarité sémantique entre textes…