Colloque Documents anciens et reconnaissance automatique des écritures manuscrites
- niveau 1 niveau 2 niveau 3
- audio 1 audio 2 audio 3
- document 1 document 2 document 3

Descriptif
Nombre de projets incluent aujourd’hui une étape d’acquisition automatique du texte dans leur chaîne de production ou d’exploitation des données. Plusieurs plateformes de transcription et différents moteurs HTR sont maintenant disponibles. L’intégration de cette technologie dans des chaînes de traitement de plus en plus efficaces a entraîné une automatisation des tâches qui remet en question la place du chercheur dans le processus d’établissement du texte. Cette nouvelle pratique, gourmande en données, rend pressant le besoin de rassembler, et donc d’harmoniser les corpus nécessaires à la constitution de corpus d’entraînement, mais aussi leur mise à disposition pour améliorer la qualité des résultats de l’HTR.
Dans le cadre du projet CREMMALab soutenu par le DIM MAP, l’École nationale des chartes (centre Jean Mabillon) en partenariat avec le LAMOP et le LabEX Hastec organise les 23 et 24 juin 2022 un colloque mêlant questions philologiques et techniques pour faire un état des lieux scientifique de l’HTR pour les documents anciens. Nous ferons le point à cette occasion sur l’HTR et ses outils, ses résultats, ses apports et les nouvelles pratiques qu’induit son utilisation dans les projets d’édition et d’exploitation des documents. Cet événement permettra de rassembler une communauté internationale de chercheurs, aujourd’hui grandissante, pour échanger autour de l’usage de l’HTR dans leurs projets scientifiques.
Enfin, ce colloque repose sur la volonté de traiter la thématique de l’HTR tout en l’articulant à des problématiques scientifiques de constitution et/ou d’exploitation des corpus. Nous souhaitons également questionner les aspects pratiques de l’utilisation de cette technologie (développement de moteur HTR, d’interface de transcription, d’interface utilisateurs pour utiliser et entrainer des modèles, etc.), tout en soulevant ses enjeux méthodologiques et son impact sur les données de la Recherche.
Colloque organisé les 23 et 24 juin 2022 à l’École nationale des chartes.
Comité d’organisation : Ariane Pinche et Floriane Chiffoleau
Comité scientifique :Jean-Baptiste Camps, Alix Chagué, Thibault Clérice, Frédéric Duval, Vincent Jolivet, Benjamin Kiessling, Nicolas Perreaux, Ariane Pinche, Laurent Romary, Peter Stokes
Vidéos
1.1 : Ouverture Colloque "Documents anciens et reconnaissance automatique des écritures manuscrites"
1.11 : SegmOnto – A Controlled Vocabulary to Describe Historical Textual Sources
1.10 : Segmentation Mode for Archival Documents with Highly Complex Layout
2.10 : Clôture Colloque "Documents anciens et reconnaissance automatique des écritures manuscrites"
2.9 : Retour d’expériences sur l’utilisation comparée de plusieurs de dispositifs de transcription numérique d’archives de fouilles archéologiques
2.8 : Reconnaissance et extraction d’informations dans des tableaux manuscrits historiques
2.7 : HTR of Handwritten Paleographic Greek Text as a Function of Chronology
2.6 : EpiSearch. Recognising Ancient Inscriptions in Epigraphic Manuscripts
2.5 : Sharing HTR datasets with standardized metadata: the HTR United initiative
2.3 : Analyse, Reconnaissance et Indexation des manuscrits CHAM
2.4 : Expérimentations pour l’analyse automatique de sources chinoises anciennes
2.2 : From HTR to Critical Edition: A Semi-Automatic Pipeline
2.1 : FoNDUE - A Lightweight HTR Infrastructure for Geneva
1.9 : Les archives inquisitoriales (Portugal) sous HTR : le projet TraPrInq (Transcribing the court records of the Portuguese Inquisition, 1536-1821)
1.7: De Transkribus à eScriptorium : retour(s) d’expérience sur l’usage d’outils d’HTR appliqués à un corpus d’imprimés espagnols du XIXe siècle
1.6 : New Developments in Kraken and eScriptorium
1.5 : Un modèle ouvert pour la reconnaissance automatique des manuscrits du théâtre espagnol du Siècle d’Or
1.3 : HTR fine tuning for medieval manuscripts models: strategies and evaluation