Les corpus des manuscrits hébreux et syriaques de la BnF et du Vatican : une analyse comparative à l’aide de l’IA
Les manuscrits en caractères hébreux conservés à la BnF et à la Bibliothèque apostolique vaticane constituent l’un des plus riches patrimoines textuels du monde juif médiéval et moderne. Cette conférence est l’occasion d’illustrer, à travers quelques exemples concrets, ce que la rencontre entre patrimoine écrit et apprentissage automatique permet aujourd’hui de découvrir.
Numérisés depuis une vingtaine d’années, ces fonds représentent plusieurs centaines de milliers de pages, dont la majorité demeure inaccessible à la recherche faute d’avoir été transcrite. Le projet ERC MiDRASH propose d’y remédier grâce à la reconnaissance automatique de l’écriture par l’intelligence artificielle qui permet de transformer les images de manuscrits en textes interrogeables. Nous présenterons brièvement le pipeline mis en place pour traiter l’intégralité de ces deux collections et montrerons comment s’ouvre désormais la voie à une exploration à grande échelle, une véritable transformation des humanités qui se dessine à l’avenir : par exemple le catalogage automatique ou la mise au jour de textes oubliés.
Par Marie Carlin, BnF, Laurent Héricher, BnF, et Daniel Stoekl Ben Ezra, EPHE
Informations pratiques
Entrée gratuite – Réservation conseillée – Ouverture des réservations un mois avant l’événement
Il est recommandé de se présenter en avance (jusqu’à 20 minutes avant la manifestation).
Date et Horaires
Jeudi 24 septembre 2026
18 h – 19 h 30
Accès
Richelieu – Salle des conférences
5, rue Vivienne – 75002 Paris
Voir toutes les séances de ce cycle
