Classification multilabel de concepts médicaux pour l’identification du profil clinique du patient (Multilabel classification of medical concepts for patient’s clinical profile identification )
La première tâche du Défi fouille de textes 2021 a consisté à extraire automatiquement, à partir de cas cliniques, les phénotypes pathologiques des patients regroupés par tête de chapitre du MeSH-maladie. La solution présentée est celle d’un classifieur multilabel basé sur un transformer. Deux transformers ont été utilisés : le camembert-large classique (run 1) et le camembert-large fine-tuné (run 2) sur des articles biomédicaux français en accès libre. Nous avons également proposé un modèle « bout-enbout », avec une première phase d’extraction d’entités nommées également basée sur un transformer de type camembert-large et un classifieur de genre sur un modèle Adaboost. Nous obtenons un très bon rappel et une précision correcte, pour une F1-mesure autour de 0,77 pour les trois runs. La performance du modèle « bout-en-bout » est similaire aux autres méthodes.
Code (0)
등록된 구현이 없습니다.
Tasks
ArticlesClassificationSimilar Papers 제목 키워드 기반
Classification multi-label \`a grande dimension pour la d\'etection de concepts m\'edicaux (Large multi-label classification for medical concepts detection)
Dans ce papier, nous pr{\'e}sentons une m{\'e}thode pour associer de fa{\c{c}}on automatique des concepts {\`a} des images. Nous nous focalisons plus particuli{\`e}rement sur des images m{\'e}dicales {\`a} annoter avec d…
ClassificationGeneral ClassificationMulti-Label ClassificationMUlTI-LABEL-ClASSIFICATIONConstruction de plongements de concepts m\'edicaux sans textes (Embedding medical concepts without texts)
Dans le domaine m{\'e}dical, beaucoup d{'}outils du TAL reposent d{\'e}sormais sur des plongements de concepts issus de l{'}UMLS. Les approches existantes pour g{\'e}n{\'e}rer ces plongements n{\'e}cessitent de grandes q…
DOING@DEFT : utilisation de lexiques pour une classification efficace de cas cliniques (In this paper, we present our participation to the DEFT 2021 task 1)
Nous présentons dans cet article notre participation à la tâche 1 de la campagne d’évaluation francophone DEFT 2021, sur l’identification du profil clinique du patient. Nous proposons une méthode évolutive et efficace en…
Identification of complex words and passages in medical documents in French
Identification de mots et passages difficiles dans les documents médicaux en français. L’objectif de la simplification automatique des textes consiste à fournir une nouvelle version de documents qui devient plus facile à…
DiagnosticMod\`ele neuronal pour la r\'esolution de la cor\'ef\'erence dans les dossiers m\'edicaux \'electroniques (Neural approach for coreference resolution in electronic health records )
La r{\'e}solution de la cor{\'e}f{\'e}rence est un {\'e}l{\'e}ment essentiel pour la constitution automatique de chronologies m{\'e}dicales {\`a} partir des dossiers m{\'e}dicaux {\'e}lectroniques. Dans ce travail, nous …
coreference-resolutionCoreference Resolution