CLISTER : Un corpus pour la similarité sémantique textuelle dans des cas cliniques en français (CLISTER : A Corpus for Semantic Textual Similarity in French Clinical Narratives)
Le TAL repose sur la disponibilité de corpus annotés pour l’entraînement et l’évaluation de modèles. Il existe très peu de ressources pour la similarité sémantique dans le domaine clinique en français. Dans cette étude, nous proposons une définition de la similarité guidée par l’analyse clinique et l’appliquons au développement d’un nouveau corpus partagé de 1 000 paires de phrases annotées manuellement en scores de similarité. Nous évaluons ensuite le corpus par des expériences de mesure automatique de similarité. Nous montrons ainsi qu’un modèle de plongements de phrases peut capturer la similarité avec des performances à l’état de l’art sur le corpus DEFT STS (Spearman=0,8343). Nous montrons également que le contenu du corpus CLISTER est complémentaire de celui de DEFT STS.
Code (0)
등록된 구현이 없습니다.
Tasks
Semantic Textual SimilaritySTSSimilar Papers 제목 키워드 기반
Combinaison d'information visuelle, conceptuelle, et contextuelle pour la construction automatique de hierarchies semantiques adaptees a l'annotation d'images
This paper proposes a new methodology to automatically build semantic hierarchies suitable for image annotation and classification. The building of the hierarchy is based on a new measure of semantic similarity. The prop…
ClassificationGeneral ClassificationSemantic SimilaritySemantic Textual SimilarityApproche supervis\'ee de calcul de similarit\'e s\'emantique entre paires de phrases (Supervised approach to compute semantic similarity between sentence pairs)
Ce papier d{\'e}crit les m{\'e}thodes que nous avons d{\'e}velopp{\'e}es pour participer aux t{\^a}ches 1 et 2 de l{'}{\'e}dition 2020 du d{\'e}fi fouille de textes (DEFT 2020). Pour la premi{\`e}re t{\^a}che, qui s{'}in…
Semantic SimilaritySemantic Textual SimilaritySentenceRepr\'esentation s\'emantique distributionnelle et alignement de conversations par chat (Distributional semantic representation and alignment of online chat conversations )
Les mesures de similarit{\'e} textuelle ont une place importante en TAL, du fait de leurs nombreuses applications, en recherche d{'}information et en classification notamment. En revanche, le dialogue fait moins l{'}obje…
E-Quotes : un outil de navigation textuelle guid\'ee par les annotations s\'emantiques (E-Quotes : A semantic annotations-driven tool for textual navigation)
Nous pr{\'e}sentons E-Quotes, un outil de navigation textuelle guid{\'e}e par les annotations s{\'e}mantiques. Le syst{\`e}me permet de localiser les mots cl{\'e}s et leurs variantes dans les citations s{\'e}mantiquement…
Décontextualiser des plongements contextuels pour construire des thésaurus distributionnels (Decontextualizing contextual embeddings for building distributional thesauri )
Même si les modèles de langue contextuels sont aujourd’hui dominants en traitement automatique des langues, les représentations qu’ils construisent ne sont pas toujours adaptées à toutes les utilisations. Dans cet articl…