Une m\'ethode non-supervis\'ee pour la segmentation morphologique et l'apprentissage de morphotactique \`a l'aide de processus de Pitman-Yor (An unsupervised method for joint morphological segmentation and morphotactics learning using Pitman-Yor processes)
Cet article pr{\'e}sente un mod{\e}le bay{\'e}sien non-param{\'e}trique pour la segmentation morphologique non supervis{\'e}e. Ce mod{\e}le semi-markovien s{'}appuie sur des classes latentes de morph{\e}mes afin de mod{\'e}liser les caract{\'e}ristiques morphotactiques du lexique, et son caract{\e}re non-param{\'e}trique lui permet de s{'}adapter aux donn{\'e}es sans avoir {\a} sp{\'e}cifier {\a} l{'}avance l{'}inventaire des morph{\e}mes ainsi que leurs classes. Un processus de Pitman-Yor est utilis{\'e} comme a priori sur les param{\e}tres afin d{'}{\'e}viter une convergence vers des solutions d{\'e}g{\'e}n{\'e}r{\'e}es et inadapt{\'e}es au traitemement automatique des langues. Les r{\'e}sultats exp{\'e}rimentaux montrent la pertinence des segmentations obtenues pour le turc et l{'}anglais. Une {\'e}tude qualitative montre {\'e}galement que le mod{\e}le inf{\e}re une morphotactique linguistiquement pertinente, sans le recours {\a} des connaissances expertes quant {\a} la structure morphologique des formes de mots.
Code (0)
등록된 구현이 없습니다.
Tasks
MORPHSimilar Papers 제목 키워드 기반
Investigation par m\'ethodes d'apprentissage des sp\'ecificit\'es langagi\`eres propres aux personnes avec schizophr\'enie (Investigating Learning Methods Applied to Language Specificity of Persons with Schizophrenia)
Nous pr{\'e}sentons des exp{\'e}riences visant {\`a} identifier automatiquement des patients pr{\'e}sentant des sympt{\^o}mes de schizophr{\'e}nie dans des conversations contr{\^o}l{\'e}es entre patients et psychoth{\'e}…
SpecificityApprentissage par imitation pour l'\'etiquetage de s\'equences : vers une formalisation des m\'ethodes d'\'etiquetage easy-first
De nombreuses m{\'e}thodes ont {\'e}t{\'e} propos{\'e}es pour acc{\'e}l{\'e}rer la pr{\'e}diction d{'}objets structur{\'e}s (tels que les arbres ou les s{\'e}quences), ou pour permettre la prise en compte de d{\'e}pendan…
Etat de l'art des m\'ethodes d'apprentissage profond pour l'extraction automatique de termes-cl\'es (State of the art of deep learning methods for automatic keyphrase extraction )
Les termes-cl{\'e}s facilitent la recherche de documents dans de larges collections de donn{\'e}es. Le co{\^u}t d{'}annotation de document en termes-cl{\'e}s tr{\`e}s {\'e}lev{\'e}, c{'}est pourquoi les chercheurs s{'}in…
Keyphrase ExtractionM\'ethodes de repr\'esentation de la langue pour l'analyse syntaxique multilingue (Language representation methods for multilingual syntactic parsing )
L{'}existence de mod{\`e}les universels pour d{\'e}crire la syntaxe des langues a longtemps {\'e}t{\'e} d{\'e}battue. L{'}apparition de ressources comme le World Atlas of Language Structures et les corpus des Universal D…
SENTERSegmentation et Interprétation de Nuages de Points pour la Modélisation d'Environnements Urbains
Dans cet article, nous pr\'esentons une m\'ethode pour la d\'etection et la classification d'artefacts au niveau du sol, comme phase de filtrage pr\'ealable \`a la mod\'elisation d'environnements urbains. La m\'ethode de…
General ClassificationModel Selection