Apprentissage par imitation pour l'\'etiquetage de s\'equences : vers une formalisation des m\'ethodes d'\'etiquetage easy-first
De nombreuses m{\'e}thodes ont {\'e}t{\'e} propos{\'e}es pour acc{\'e}l{\'e}rer la pr{\'e}diction d{'}objets structur{\'e}s (tels que les arbres ou les s{\'e}quences), ou pour permettre la prise en compte de d{\'e}pendances plus riches afin d{'}am{\'e}liorer les performances de la pr{\'e}diction. Ces m{\'e}thodes reposent g{\'e}n{\'e}ralement sur des techniques d{'}inf{\'e}rence approch{\'e}e et ne b{\'e}n{\'e}ficient d{'}aucune garantie th{\'e}orique aussi bien du point de vue de la qualit{\'e} de la solution trouv{\'e}e que du point de vue de leur crit{\e}re d{'}apprentissage. Dans ce travail, nous {\'e}tudions une nouvelle formulation de l{'}apprentissage structur{\'e} qui consiste {\a} voir celui-ci comme un processus incr{\'e}mental au cours duquel la sortie est construite de fa{\c{c}}on progressive. Ce cadre permet de formaliser plusieurs approches de pr{\'e}diction structur{\'e}e existantes. Gr{\^a}ce au lien que nous faisons entre apprentissage structur{\'e} et apprentissage par renforcement, nous sommes en mesure de proposer une m{\'e}thode th{\'e}oriquement bien justifi{\'e}e pour apprendre des m{\'e}thodes d{'}inf{\'e}rence approch{\'e}e. Les exp{\'e}riences que nous r{\'e}alisons sur quatre t{\^a}ches de TAL valident l{'}approche propos{\'e}e.
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
Un outil d'\'etiquetage rapide et un corpus libre en entit\'es nomm\'ees du Fran\ccais (A fast tagging tool and a free French named entity corpus)
Dans cet article, nous pr{\'e}sentons un outil pour effectuer l{'}{\'e}tiquetage rapide de textes bruts. Il peut charger des documents annot{\'e}s depuis divers formats, notamment BRAT et GATE. Il se base sur des raccour…
NERDivergences entre annotations dans le projet Universal Dependencies et leur impact sur l'\'evaluation des performance d'\'etiquetage morpho-syntaxique (Evaluating Annotation Divergences in the UD Project)
Ce travail montre que la d{\'e}gradation des performances souvent observ{\'e}e lors de l{'}application d{'}un analyseur morpho-syntaxique {\`a} des donn{\'e}es hors domaine r{\'e}sulte souvent d{'}incoh{\'e}rences entre …
Aprentissage non-supervis\'e pour l'appariement et l'\'etiquetage de cas cliniques en fran\ccais - DEFT2019 (Unsupervised learning for matching and labelling of french clincal cases - DEFT2019 )
Nous pr{\'e}sentons le syst{\`e}me utilis{\'e} par l{'}{\'e}quipe Synapse/IRIT dans la comp{\'e}tition DEFT2019 portant sur deux t{\^a}ches li{\'e}es {\`a} des cas cliniques r{\'e}dig{\'e}s en fran{\c{c}}ais : l{'}une d{…
Etiquetage morpho-syntaxique de tweets avec des CRF
Nous nous int{\'e}ressons dans cet article {\`a} l{'}apprentissage automatique d{'}un {\'e}tiqueteur mopho-syntaxique pour les tweets en anglais. Nous proposons tout d{'}abord un jeu d{'}{\'e}tiquettes r{\'e}duit avec 17…