Classification de texte enrichie \`a l'aide de motifs s\'equentiels
En classification de textes, la plupart des m{\'e}thodes fond{\'e}es sur des classifieurs statistiques utilisent des mots, ou des combinaisons de mots contigus, comme descripteurs. Si l{'}on veut prendre en compte plus d{'}informations le nombre de descripteurs non contigus augmente exponentiellement. Pour pallier {\a} cette croissance, la fouille de motifs s{\'e}quentiels permet d{'}extraire, de fa{\c{c}}on efficace, un nombre r{\'e}duit de descripteurs qui sont {\a} la fois fr{\'e}quents et pertinents gr{\^a}ce {\`a} l{'}utilisation de contraintes. Dans ce papier, nous comparons l{'}utilisation de motifs fr{\'e}quents sous contraintes et l{'}utilisation de motifs -libres, comme descripteurs. Nous montrons les avantages et inconv{\'e}nients de chaque type de motif.
Code (0)
등록된 구현이 없습니다.
Tasks
ClassificationGeneral ClassificationSimilar Papers 제목 키워드 기반
Adaptation par enrichissement terminologique en traduction automatique statistique fond\'ee sur la g\'en\'eration et le filtrage de bi-segments virtuels
Nous pr{\'e}sentons des travaux pr{\'e}liminaires sur une approche permettant d{'}ajouter des termes bilingues {\`a} un syst{\`e}me de Traduction Automatique Statistique (TAS) {\`a} base de segments. Les termes sont non …
Une mesure d'int\'er\^et \`a base de surrepr\'esentation pour l'extraction des motifs syntaxiques stylistiques
Dans cette contribution, nous pr{\'e}sentons une {\'e}tude sur la stylistique computationnelle des textes de la litt{\'e}rature classiques fran{\c{c}}aise fond{\'e}e sur une approche conduite par donn{\'e}es, o{\`u} la d…
SENTERIdentification de descripteurs pour la caract\'erisation de registres (Feature identification for register characterization)
L{'}article pr{\'e}sente une {\'e}tude des descripteurs linguistiques pour la caract{\'e}risation d{'}un texte selon son registre de langue (familier, courant, soutenu). Cette {\'e}tude a pour but de poser un premier jal…
Classification automatique de dict\'ees selon leur niveau de difficult\'e de compr\'ehension et orthographique (Automatic classification of dictations according to their complexity for comprehension and writing production)
Cet article pr{\'e}sente une approche visant {\`a} {\'e}valuer automatiquement la difficult{\'e} de dict{\'e}es en vue de les int{\'e}grer dans une plateforme d{'}apprentissage de l{'}orthographe. La particularit{\'e} de…
es-enGeneral ClassificationFouille de motifs et CRF pour la reconnaissance de sympt\^omes dans les textes biom\'edicaux (Pattern mining and CRF for symptoms recognition in biomedical texts)
Dans cet article, nous nous int{\'e}ressons {\`a} l{'}extraction d{'}entit{\'e}s m{\'e}dicales de type sympt{\^o}me dans les textes biom{\'e}dicaux. Cette t{\^a}che est peu explor{\'e}e dans la litt{\'e}rature et il n{'}…
NER