Quels corpus d'entraînement pour l'expansion de requêtes par plongement de mots : application à la recherche de microblogs culturels
We describe here an experimental framework and the results obtained on microblogs retrieval. We study the contribution one popular approach, i.e., words embeddings, and investigate the impact of the training set on the learned embedding. We focus on query expansion for the retrieval of tweets on the CLEF CMC 2016 corpus. Our results show that using embeddings trained on a corpus in the same domain as the indexed documents did not necessarily lead to better retrieval results.
Code (0)
등록된 구현이 없습니다.
Tasks
RetrievalSimilar Papers 제목 키워드 기반
Génération de question à partir d’analyse sémantique pour l’adaptation non supervisée de modèles de compréhension de documents (Question generation from semantic analysis for unsupervised adaptation of document understanding models)
La génération automatique de questions à partir de textes peut permettre d’obtenir des corpus d’apprentissage pour des modèles de compréhension de documents de type question/réponse sur des textes. Si cette tâche de géné…
document understandingQuestion GenerationQuestion-GenerationR\^ole des contextes lexical et post-lexical dans la r\'ealisation du schwa : apports du traitement automatique de grands corpus (Role of lexical and post-lexical contexts in French schwa realisations : benefits of automatic processing of large corpora )
Le r{\^o}le du contexte est connu dans la r{\'e}alisation ou non du schwa en fran{\c{c}}ais. Deux grands corpus oraux de parole journalistique (ETAPE) et de parole famili{\`e}re (NCCFr), dans lesquels la realisation de s…
Quels tests d'intelligibilit\'e pour \'evaluer les troubles de production de la parole ? (What kind of intelligibility test to assess speech production disorders?)
L{'}intelligibilit{\'e} de la parole se d{\'e}finit comme le degr{\'e} de pr{\'e}cision avec lequel un message est compris par un auditeur. A ce titre, la perte d{'}intelligibilit{\'e} repr{\'e}sente souvent une plainte …
Open Information Extraction: Approche Supervisée et Syntaxique pour le Français (Supervised Syntactic Approach for French Open Information Extraction)
L’ Open Information Extraction, est un paradigme d’extraction conçu pour gérer l’adaptation de domaine, la principale difficulté des approches traditionnelles pour l’extraction d’informations. Cependant, la plupart des a…
Open Information ExtractionAnalyse syntaxique de l'ancien fran\ccais : quelles propri\'et\'es de la langue influent le plus sur la qualit\'e de l'apprentissage ?
L{'}article pr{\'e}sente des r{\'e}sultats d{'}exp{\'e}riences d{'}apprentissage automatique pour l{'}{\'e}tiquetage morpho-syntaxique et l{'}analyse syntaxique en d{\'e}pendance de l{'}ancien fran{\c{c}}ais. Ces exp{\'e…