D\'eclasser les voisins non s\'emantiques pour am\'eliorer les th\'esaurus distributionnels
La plupart des m{\'e}thodes d{'}am{\'e}lioration des th{\'e}saurus distributionnels se focalisent sur les moyens {--} repr{\'e}sentations ou mesures de similarit{\'e} {--} de mieux d{\'e}tecter la similarit{\'e} s{\'e}mantique entre les mots. Dans cet article, nous proposons un point de vue inverse : nous cherchons {\a} d{\'e}tecter les voisins s{\'e}mantiques associ{\'e}s {\a} une entr{\'e}e les moins susceptibles d{'}{\^e}tre li{\'e}s s{\'e}mantiquement {\a} elle et nous utilisons cette information pour r{\'e}ordonner ces voisins. Pour d{\'e}tecter les faux voisins s{\'e}mantiques d{'}une entr{\'e}e, nous adoptons une approche s{'}inspirant de la d{\'e}sambigu{\"\i}sation s{\'e}mantique en construisant un classifieur permettant de diff{\'e}rencier en contexte cette entr{\'e}e des autres mots. Ce classifieur est ensuite appliqu{\'e} {\a} un {\'e}chantillon des occurrences des voisins de l{'}entr{\'e}e pour rep{\'e}rer ceux les plus {\'e}loign{\'e}s de l{'}entr{\'e}e. Nous {\'e}valuons cette m{\'e}thode pour des th{\'e}saurus construits {\`a} partir de cooccurrents syntaxiques et nous montrons l{'}int{\'e}r{\^e}t de la combiner avec les m{\'e}thodes d{\'e}crites dans (Ferret, 2013b) selon une strat{\'e}gie de type vote.
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
Unsupervised selection of semantic relations for improving a distributional thesaurus (S\'election non supervis\'ee de relations s\'emantiques pour am\'eliorer un th\'esaurus distributionnel) [in French]
Exploring the neighbor graph to improve distributional thesauri (Explorer le graphe de voisinage pour am\'eliorer les th\'esaurus distributionnels) [in French]
Combinaison d'information visuelle, conceptuelle, et contextuelle pour la construction automatique de hierarchies semantiques adaptees a l'annotation d'images
This paper proposes a new methodology to automatically build semantic hierarchies suitable for image annotation and classification. The building of the hierarchy is based on a new measure of semantic similarity. The prop…
ClassificationGeneral ClassificationSemantic SimilaritySemantic Textual SimilarityD\'esambigu\"\isation lexicale \`a base de connaissances par s\'election distributionnelle et traits s\'emantiques
La d{\'e}sambigu{\"\i}sation lexicale permet d{'}am{\'e}liorer de nombreuses applications en traitement automatique des langues (TAL) comme la recherche d{'}information, l{'}extraction d{'}information, la traduction auto…