Une IA aux petits oignons pour les déchiffrer/traduire tous. Je cite:
Deux cents mille lignes transcrites à la main
Cette approche a donné naissance au projet CATMuS (pour Consistent Approaches to Transcribing Manuscripts), lancé au début des années 2020 à l'initiative d'Ariane Pinche, chargée de recherche au CNRS. Objectif : bâtir un corpus d'apprentissage cohérent avant même de songer à entraîner un algorithme.
Pendant plusieurs années, l'équipe a transcrit à la main 200 000 lignes issues de 300 manuscrits différents, en 11 langues, couvrant du IXe au XVIe siècle. Une autre version de CATMuS couvre la période allant du XVIe au XXIe siècle. Les documents ont été choisis non pas selon les sujets de recherche des uns et des autres, mais pour maximiser la diversité du jeu de données.

Source: futura-sciences.com
