R\'eutilisation de Textes dans les Manuscrits Anciens (Text Reuse in Ancient Manuscripts)
Nous nous int{\'e}ressons dans cet article {\a} la probl{\'e}matique de r{\'e}utilisation de textes dans les livres liturgiques du Moyen {\^A}ge. Plus particuli{\e}rement, nous {\'e}tudions les variations textuelles de la pri{\`e}re Obsecro Te souvent pr{\'e}sente dans les livres d{'}heures. L{'}observation manuelle de 772 copies de l{'}Obsecro Te a montr{\'e} l{'}existence de plus de 21 000 variantes textuelles. Dans le but de pouvoir les extraire automatiquement et les cat{\'e}goriser, nous proposons dans un premier temps une classification lexico-s{\'e}mantique au niveau n-grammes de mots pour ensuite rendre compte des performances de plusieurs approches {\'e}tat-de-l{'}art d{'}appariement automatique de variantes textuelles de l{'}Obsecro Te.
Code (0)
등록된 구현이 없습니다.
Similar Papers 제목 키워드 기반
Ph\oebus : un Logiciel d'Extraction de R\'eutilisations dans des Textes Litt\'eraires
Ph{\oe}bus est un logiciel d{'}extraction de r{\'e}utilisations dans des textes litt{\'e}raires. Il a {\'e}t{\'e} d{\'e}velopp{\'e} comme un outil d{'}analyse litt{\'e}raire assist{\'e}e par ordinateur. Dans ce contexte,…
D\'ecodeur neuronal pour la transcription de documents manuscrits anciens (Neural decoder for the transcription of historical handwritten documents)
L{'}absence de donn{\'e}es annot{\'e}es peut {\^e}tre une difficult{\'e} majeure lorsque l{'}on s{'}int{\'e}resse {\`a} l{'}analyse de documents manuscrits anciens. Pour contourner cette difficult{\'e}, nous proposons de…
DecoderSTAM : traduction des textes non structur\'es (dialectes du Maghreb) (STAM: Translation of unstructured text (Maghreb dialects) The use of communication platforms (social networks, discussion forums)
L{'}utilisation des plateformes de communication (r{\'e}seaux sociaux, forums de discussions, ...) a pris une ampleur consid{\'e}rable. Ces plateformes permettent aux internautes d{'}exprimer leur avis concernant un suje…
Transformations syntaxiques entre niveaux de simplification dans le corpus Newsela (Syntactic transformations between simplification levels in the Newsela corpus)
La simplification de textes est une t{\^a}che complexe du traitement automatique des langues. Depuis quelques ann{\'e}es, des corpus parall{\`e}les de textes originaux et simplifi{\'e}s sont propos{\'e}s, permettant d{'}…
MEDITE : logiciel d'alignement de textes pour l'\'etude de la g\'en\'etique textuelle
MEDITE est un logiciel d{'}alignement de textes permettant l{'}identification de transformations entre une version et une autre d{'}un m{\^e}me texte. Dans ce papier nous pr{\'e}sentons les aspects th{\'e}oriques et tech…