RésumeSVD : Un outil efficace et performant pour le résumé de texte non supervisé (RésumeSVD : An efficient and effective tool for unsupervised text summarization )
Cet article présente une nouvelle méthode, RésumeSVD, pour le résumé automatique extractif non supervisé. Cette méthode est fondée sur la décomposition en valeurs singulières afin de réduire la dimensionnalité des plongements de mots et de proposer une représentation de ces derniers sur un petit nombre de dimensions, chacune représentant un sujet latent. En effet, dans un contexte spécifique et restreint, de multiples dimensions des plongements de mots deviennent moins pertinentes puisqu’apprises dans des contextes plus larges. Elle utilise également le regroupement automatique de mots pour réduire la taille du vocabulaire, et est suivie d’une heuristique d’extraction de phrases. La méthode surpasse en efficacité les approches extractives les plus récentes tout en étant plus efficiente. De plus, RésumeSVD nécessite peu de ressources, en termes de données et de puissance de calcul. Elle peut donc être exécutée sur de longs documents, tels que des articles scientifiques, ainsi que sur de grands corpus à documents multiples. Notre méthode est suffisamment rapide pour être utilisée dans des systèmes de résumé en direct. Nous partageons publiquement le code source de notre approche permettant de reproduire tous nos résultats.
Code (0)
등록된 구현이 없습니다.
Tasks
ArticlesText SummarizationUnsupervised Text SummarizationSimilar Papers 제목 키워드 기반
D\'etection automatique de phrases en domaine de sp\'ecialit\'e en fran\ccais (Sentence boundary detection for specialized domains in French )
La d{\'e}tection de fronti{\`e}res de phrase est g{\'e}n{\'e}ralement consid{\'e}r{\'e} comme un probl{\`e}me r{\'e}solu. Cependant, les outils performant sur des textes en domaine g{\'e}n{\'e}ral, ne le sont pas forceme…
Boundary DetectionSentenceUn outil d'\'etiquetage rapide et un corpus libre en entit\'es nomm\'ees du Fran\ccais (A fast tagging tool and a free French named entity corpus)
Dans cet article, nous pr{\'e}sentons un outil pour effectuer l{'}{\'e}tiquetage rapide de textes bruts. Il peut charger des documents annot{\'e}s depuis divers formats, notamment BRAT et GATE. Il se base sur des raccour…
NERWordsurf : un outil pour naviguer dans un espace de « Word Embeddings » (Wordsurf : a tool to surf in a ``word embeddings'' space)
Dans cet article, nous pr{\'e}sentons un outil appel{\'e} « Wordsurf » pour faciliter la phase d{'}exploration et de navigation dans un espace de « Word Embeddings » pr{\'e}alablement entrain{\'e} sur des corpus de texte…
Word EmbeddingsExploitation de mod\`eles distributionnels pour l'\'etude de la nomination dans un corpus d'interviews politiques (Speaker-specific semantic variation representations using vector space models)
En analyse de discours (AD), la nomination d{\'e}signe la recat{\'e}gorisation du r{\'e}f{\'e}rent par le locuteur {\`a} travers l{'}usage d{'}un nouveau nom ou d{'}un nom modifi{\'e}. Parfois utilis{\'e} pour influencer…
Utilisation d'indices phras\'eologiques pour \'evaluer des textes en langue \'etrang\`ere : comparaison des bigrammes et des trigrammes (Collocation measures and automated scoring of foreign language texts : Comparing bigrams and trigrams)
Cette recherche a pour principal objectif d{'}{\'e}valuer l{'}utilit{\'e} de prendre en compte des mesures totalement automatiques de la comp{\'e}tence phras{\'e}ologique pour estimer la qualit{\'e} de textes d{'}apprena…
SENTS