Mod\'elisation unifi\'ee du document et de son domaine pour une indexation par termes-cl\'es libre et contr\^ol\'ee (Unified document and domain-specific model for keyphrase extraction and assignment )
Dans cet article, nous nous int{\'e}ressons {\a} l{'}indexation de documents de domaines de sp{\'e}cialit{\'e} par l{'}interm{\'e}diaire de leurs termes-cl{\'e}s. Plus particuli{\e}rement, nous nous int{\'e}ressons {\a} l{'}indexation telle qu{'}elle est r{\'e}alis{\'e}e par les documentalistes de biblioth{\e}ques num{\'e}riques. Apr{\e}s analyse de la m{\'e}thodologie de ces indexeurs professionnels, nous proposons une m{\'e}thode {\a} base de graphe combinant les informations pr{\'e}sentes dans le document et la connaissance du domaine pour r{\'e}aliser une indexation (hybride) libre et contr{\^o}l{\'e}e. Notre m{\'e}thode permet de proposer des termes-cl{\'e}s ne se trouvant pas n{\'e}cessairement dans le document. Nos exp{\'e}riences montrent aussi que notre m{\'e}thode surpasse significativement l{'}approche {\`a} base de graphe {\'e}tat de l{'}art.
Code (0)
등록된 구현이 없습니다.
Tasks
Keyphrase ExtractionSimilar Papers 제목 키워드 기반
D\'Efi Fouille de Textes 2019 : indexation par extraction et appariement textuel (DEFT 2019 : extraction-based document indexing and textual document similarity matching )
Cet article pr{\'e}sente la contribution de l{'}{\'e}quipe du Laboratoire de G{\'e}nie Informatique et d{'}Ing{\'e}nierie de Production (LGI2P) d{'}IMT Mines Al{\`e}s au D{\'E}fi Fouille de Textes (DEFT) 2019. Il d{\'e}t…
SENTERIndexation et appariement de documents cliniques avec le mod\`ele vectoriel (Indexing and matching clinical documents using the vector space model)
Dans ce papier, nous pr{\'e}sentons les m{\'e}thodes que nous avons d{\'e}velopp{\'e}es pour participer aux t{\^a}ches 1 et 2 de l{'}{\'e}dition 2019 du d{\'e}fi fouille de textes (DEFT 2019). Pour la premi{\`e}re t{\^a}…
Indexation et appariements de documents cliniques pour le Deft 2019 (Indexing and pairing texts of the medical domain )
Dans cet article, nous pr{\'e}sentons nos m{\'e}thodes pour les t{\^a}ches d{'}indexation et d{'}appariements du D{\'e}fi Fouile de Textes (Deft) 2019. Pour la ta{\^c}he d{'}indexation nous avons test{\'e} deux m{\'e}tho…
Une approche hybride pour la segmentation automatique de documents juridiques (A hybrid approach for automatic text segmentation)
Cet article 1 propose une approche hybride pour la segmentation de documents bas{\'e}e sur l{'}agr{\'e}gation de diff{\'e}rentes solutions. Divers algorithmes de segmentation peuvent {\^e}tre utilis{\'e}s dans le syst{\`…
Text SegmentationN\'eonaute, Enrichissement s\'emantique pour la recherche d'information ()
Avec l{'}explosion du nombre de documents num{\'e}riques accessibles, les besoins en outils pour l{'}enrichissement s{\'e}mantique des donn{\'e}es textuelles, ainsi que des fonctionnalit{\'e}s avanc{\'e}es de recherche e…