paper-with-me

Papers

D\'Efi Fouille de Textes 2019 : indexation par extraction et appariement textuel (DEFT 2019 : extraction-based document indexing and textual document similarity matching )

2019-07-01 · JEPTALNRECITAL 2019 7 · Jean-Christophe Mensonides, Pierre-Antoine Jean, Andon Tchechmedjiev, S{\'e}bastien Harispe

Cet article pr{\'e}sente la contribution de l{'}{\'e}quipe du Laboratoire de G{\'e}nie Informatique et d{'}Ing{\'e}nierie de Production (LGI2P) d{'}IMT Mines Al{\e}s au D{\'E}fi Fouille de Textes (DEFT) 2019. Il d{\'e}taille en particulier deux approches propos{\'e}es pour les t{\^a}ches li{\'e}es {\a} (1) l{'}indexation et {\a} (2) la similarit{\'e} de documents. Ces m{\'e}thodes reposent sur des techniques robustes et {\'e}prouv{\'e}es du domaine de la Recherche d{'}Information et du Traitement Automatique du Langage Naturel, qui ont {\'e}t{\'e} adapt{\'e}es {\a} la nature sp{\'e}cifique du corpus (biom{\'e}dical/clinique) et coupl{\'e}es {\a} des m{\'e}canismes d{\'e}velopp{\'e}s pour r{\'e}pondre aux sp{\'e}cificit{\'e}s des t{\^a}ches trait{\'e}es. Pour la t{\^a}che 1, nous proposons une m{\'e}thode d{'}indexation par extraction appliqu{\'e}e sur une version normalis{\'e}e du corpus (MAP de 0,48 {\a} l{'}{\'e}valuation) ; les sp{\'e}cificit{\'e}s de la phase de normalisation seront en particulier d{\'e}taill{\'e}es. Pour la t{\^a}che 2, au-del{\a} de la pr{\'e}sentation de l{'}approche propos{\'e}e bas{\'e}e sur l{'}{\'e}valuation de similarit{\'e}s sur des repr{\'e}sentations de documents (score de 0,91 {\a} l{'}{\'e}valuation), nous proposons une {\'e}tude comparative de l{'}impact des choix de la distance et de la mani{\`e}re de repr{\'e}senter les textes sur la performance de l{'}approche.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Tasks

SENTER

Similar Papers 제목 키워드 기반

Indexation et appariement de documents cliniques avec le mod\`ele vectoriel (Indexing and matching clinical documents using the vector space model)

2019-07-01 · JEPTALNRECITAL 2019 7 · Khadim Dram{\'e}, Ibrahima Diop, Lamine Faty, Birame Ndoye

Dans ce papier, nous pr{\'e}sentons les m{\'e}thodes que nous avons d{\'e}velopp{\'e}es pour participer aux t{\^a}ches 1 et 2 de l{'}{\'e}dition 2019 du d{\'e}fi fouille de textes (DEFT 2019). Pour la premi{\`e}re t{\^a}…

Indexation et appariements de documents cliniques pour le Deft 2019 (Indexing and pairing texts of the medical domain )

2019-07-01 · JEPTALNRECITAL 2019 7 · Davide Buscaldi, Dhaou Ghoul, Joseph Le Roux, Ga{\"e}l Lejeune

Dans cet article, nous pr{\'e}sentons nos m{\'e}thodes pour les t{\^a}ches d{'}indexation et d{'}appariements du D{\'e}fi Fouile de Textes (Deft) 2019. Pour la ta{\^c}he d{'}indexation nous avons test{\'e} deux m{\'e}tho…

Indexation libre et contr\^ol\'ee d'articles scientifiques. Pr\'esentation et r\'esultats du d\'efi fouille de textes DEFT2012 (Controlled and free indexing of scientific papers. Presentation and results of the DEFT2012 text-mining challenge) [in French]

2012-06-01 · JEPTALNRECITAL 2012 6 · Patrick Paroubek, Pierre Zweigenbaum, Dominic Forest, Cyril Grouin
Lemmatization

R\'eutilisation de Textes dans les Manuscrits Anciens (Text Reuse in Ancient Manuscripts)

2019-07-01 · JEPTALNRECITAL 2019 7 · Amir Hazem, B{\'e}atrice Daille, Dominique Stutzmann, Jacob Currie 외

Nous nous int{\'e}ressons dans cet article {\`a} la probl{\'e}matique de r{\'e}utilisation de textes dans les livres liturgiques du Moyen {\^A}ge. Plus particuli{\`e}rement, nous {\'e}tudions les variations textuelles de…

Qwant Research @DEFT 2019 : appariement de documents et extraction d'informations \`a partir de cas cliniques (Document matching and information retrieval using clinical cases)

2019-07-01 · JEPTALNRECITAL 2019 7 · Estelle Maudet, Oralie Cattan, Maureen de Seyssel, Christophe Servan

Dans ce papier, nous pr{\'e}sentons la participation de Qwant Research aux t{\^a}ches 2 et 3 de l{'}{\'e}dition 2019 du d{\'e}fi fouille de textes (DEFT) portant sur l{'}analyse de documents cliniques r{\'e}dig{\'e}s en …

Information RetrievalRetrieval