Algorithme de recherche approximative dans un dictionnaire fondé sur une distance d'édition définie par blocs
We propose an algorithm for approximative dictionary lookup, where altered strings are matched against reference forms. The algorithm makes use of a divergence function between strings -- broadly belonging to the family of edit distances; it finds dictionary entries whose distance to the search string is below a certain threshold. The divergence function is not the classical edit distance (DL distance); it is adaptable to a particular corpus, and is based on elementary alteration costs defined on character blocks, rather than on individual characters. Nous proposons un algorithme de recherche approximative de cha\^ines dans un dictionnaire \a partir de formes alt\'er\'ees. Cet algorithme est fond\'e sur une fonction de divergence entre cha\^ines~ -- une sorte de distance d'\'edition: il recherche des entr\'ees pour lesquelles la distance \a la cha\^ine cherch\'ee est inf\'erieure \a un certain seuil. La fonction utilis\'ee n'est pas la distance d'\'edition classique (distance DL); elle est adapt\'ee \a un corpus, et se fonde sur la prise en compte de co\^uts d'alt\'eration \'el\'ementaires d\'efinis non pas sur des caract\eres, mais sur des sous-cha\^ines (des blocs de caract\eres).
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
OKM: une extension des k-moyennes pour la recherche de classes recouvrantes.
Dans cet article nous abordons le problème de la classification (ou clustering) dans le but de découvrir des classes avec recouvrements. Malgré quelques avancées récentes dans ce domaines, motivées par des besoins applic…
ClassificationIdentification des Expressions Polylexicales dans les Tweets (Identification of Multiword Expressions in Tweets)
L’identification des expressions polylexicales (EP) dans les tweets est une tâche difficile en raison de la nature linguistique complexe des EP combinée à l’utilisation d’un langage non standard. Dans cet article, nous p…
Etat de l'art des m\'ethodes d'apprentissage profond pour l'extraction automatique de termes-cl\'es (State of the art of deep learning methods for automatic keyphrase extraction )
Les termes-cl{\'e}s facilitent la recherche de documents dans de larges collections de donn{\'e}es. Le co{\^u}t d{'}annotation de document en termes-cl{\'e}s tr{\`e}s {\'e}lev{\'e}, c{'}est pourquoi les chercheurs s{'}in…
Keyphrase ExtractionUne Approche \'evolutionnaire pour le r\'esum\'e automatique
Dans cet article, nous proposons une m{\'e}thode de r{\'e}sum{\'e} automatique fond{\'e}e sur l{'}utilisation d{'}un algorithme g{\'e}n{\'e}tique pour parcourir l{'}espace des r{\'e}sum{\'e}s candidats coupl{\'e} {\`a} u…
Extraction et analyse automatique des comparaisons et des pseudo-comparaisons pour la d\'etection des comparaisons figuratives
Le pr{\'e}sent article s{'}int{\'e}resse {\`a} la d{\'e}tection et {\`a} la d{\'e}sambigu{\"\i}sation des comparaisons figuratives. Il d{\'e}crit un algorithme qui utilise un analyseur syntaxique de surface (chunker) et …