paper-with-me

Papers

D\'etection d'erreurs dans des transcriptions OCR de documents historiques par r\'eseaux de neurones r\'ecurrents multi-niveau (Combining character level and word level RNNs for post-OCR error detection)

2018-05-01 · JEPTALNRECITAL 2018 5 · Thibault Magallon, Frederic Bechet, Benoit Favre

Le traitement {\a} posteriori de transcriptions OCR cherche {\a} d{\'e}tecter les erreurs dans les sorties d{'}OCR pour tenter de les corriger, deux t{\^a}ches {\'e}valu{\'e}es par la comp{\'e}tition ICDAR-2017 Post-OCR Text Correction. Nous pr{\'e}senterons dans ce papier un syst{\e}me de d{\'e}tection d{'}erreurs bas{\'e} sur un mod{\e}le {\a} r{\'e}seaux r{\'e}currents combinant une analyse du texte au niveau des mots et des caract{\e}res en deux temps. Ce syst{\`e}me a {\'e}t{\'e} class{\'e} second dans trois cat{\'e}gories {\'e}valu{\'e}es parmi 11 candidats lors de la comp{\'e}tition.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Tasks

Optical Character Recognition (OCR)

Similar Papers 제목 키워드 기반

Simulation d’erreurs d’OCR dans les systèmes de TAL pour le traitement de données anachroniques (Simulation of OCR errors in NLP systems for processing anachronistic data)

2022-06-01 · JEP/TALN/RECITAL 2022 6 · Baptiste Blouin, Benoit Favre, Jeremy Auguste

L’extraction d’information offre de nouvelles perspectives au sein des recherches historiques. Cependant, la majorité des recherches liées à ce domaine s’effectue sur des données contemporaines. Malgré l’évolution consta…

Optical Character Recognition (OCR)

D\'etection et caract\'erisation des r\'egions d'erreurs dans des transcriptions de contenus multim\'edia : application \`a la recherche des noms de personnes (Error region detection and characterization in transcriptions of multimedia documents : application to person name search) [in French]

2012-06-01 · JEPTALNRECITAL 2012 6 · Richard Dufour, G{\'e}raldine Damnati, Delphine Charlet

Utilisation des repr\'esentations continues des mots et des param\`etres prosodiques pour la d\'etection d'erreurs dans les transcriptions automatiques de la parole (Combining continuous word representation and prosodic features for ASR error detection)

2016-07-01 · JEPTALNRECITAL 2016 7 · Sahar Ghannay, Yannick Est{\`e}ve, Nathalie Camelin, Camille Dutrey 외

R{\'e}cemment, l{'}utilisation des repr{\'e}sentations continues de mots a connu beaucoup de succ{\`e}s dans plusieurs t{\^a}ches de traitement du langage naturel. Dans cet article, nous proposons d{'}{\'e}tudier leur ut…

Exploiter des mod\`eles de langue pour \'evaluer des sorties de logiciels d'OCR pour des documents fran\ccais du XVIIe si\`ecle ()

2020-06-01 · JEPTALNRECITAL 2020 6 · Jean-Baptiste Tanguy

Pour comparer deux sorties de logiciels d{'}OCR, le Character Error Rate (ou, CER) est fr{\'e}quemment utilis{\'e}. Moyennant l{'}existence d{'}une transcription de r{\'e}f{\'e}rence de qualit{\'e} pour certains document…

Optical Character Recognition (OCR)

ACCOLÉ : Annotation Collaborative d’erreurs de traduction pour COrpus aLignÉs, multi-cibles, et Annotation d’Expressions Poly-lexicales (ACCOLÉ: A Collaborative Platform of Error Annotation for Aligned)

2021-06-01 · JEP/TALN/RECITAL 2021 6 · Emmanuelle Esperança-Rodier, Francis Brunet-Manquat

Cette démonstration présente les avancées d’ACCOLÉ (Annotation Collaborative d’erreurs de traduction pour COrpus aLignÉs), qui en plus de proposer une gestion simplifiée des corpus et des typologies d’erreurs, l’annotati…