Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

Apprentissage profond auto-supervisé de métriques : application à la prédiction d'assemblage de fragments de papyrus

View through CrossRef
Dans cette thèse est présenté le développement de méthodes d’apprentissage profond pour proposer des appairages pertinents de fragments de documents, appliquées à la reconstruction de papyrus anciens. Nous avons conçu une méthode basée sur des réseaux de neurones siamois profonds ainsi qu’une approche auto-supervisée pour pallier le problème de la faible quantité de données d’entraînement annotées disponibles dans ce domaine. Ce travail fait partie du projet GESHAEM, une initiative de recherche scientifique financée par le Conseil Européen de la Recherche (European Research Council, ERC). Son objectif est d’étudier un corpus papyrologique, la collection Jouguet de la Sorbonne, composé de papyrus qui ont été déchirés pour fabriquer des ornements funéraires. Ces papyrus sont pour la plupart des documents administratifs et fiscaux dont le contenu est très utile pour les historiens afin de mieux comprendre la façon dont ces sociétés anciennes étaient organisées. Cependant, de part le fait que les papyrus ont été déchirés il y a environ 2000 ans, et qu’ils ont été très dégradés à cause du temps et des conditions de conservation, leur étude nécessite un grand travail de reconstruction par les papyrologues. C’est un processus long et fastidieux s’il est fait à la main, car la collection est composée de centaines de fragments. L’objectif de ce travail est ainsi de calculer des suggestions d’appairages de fragments aux papyrologues afin d’accélérer le processus de reconstruction. Nous proposons une approche basée sur des patchs utilisant des réseaux de neurones siamois profonds pour calculer un score de similarité entre deux fragments de papyrus. La difficulté d’obtenir des données annotées en grande quantité rend difficile la construction d’un modèle fonctionnant sur différents types de documents. Pour cela, nous proposons une méthodologie d’apprentissage auto-supervisée exploitant la structure intrinsèque des documents. Cette méthode permet d’entraîner des réseaux de neurones siamois profonds sans avoir besoin de données annotées. Nous avons aussi constitué une base de données prête à l’emploi basée sur la collection de papyrus de l’Université du Michigan, que nous avons ouverte à la communauté.
Agence Bibliographique de l'Enseignement Supérieur
Title: Apprentissage profond auto-supervisé de métriques : application à la prédiction d'assemblage de fragments de papyrus
Description:
Dans cette thèse est présenté le développement de méthodes d’apprentissage profond pour proposer des appairages pertinents de fragments de documents, appliquées à la reconstruction de papyrus anciens.
Nous avons conçu une méthode basée sur des réseaux de neurones siamois profonds ainsi qu’une approche auto-supervisée pour pallier le problème de la faible quantité de données d’entraînement annotées disponibles dans ce domaine.
Ce travail fait partie du projet GESHAEM, une initiative de recherche scientifique financée par le Conseil Européen de la Recherche (European Research Council, ERC).
Son objectif est d’étudier un corpus papyrologique, la collection Jouguet de la Sorbonne, composé de papyrus qui ont été déchirés pour fabriquer des ornements funéraires.
Ces papyrus sont pour la plupart des documents administratifs et fiscaux dont le contenu est très utile pour les historiens afin de mieux comprendre la façon dont ces sociétés anciennes étaient organisées.
Cependant, de part le fait que les papyrus ont été déchirés il y a environ 2000 ans, et qu’ils ont été très dégradés à cause du temps et des conditions de conservation, leur étude nécessite un grand travail de reconstruction par les papyrologues.
C’est un processus long et fastidieux s’il est fait à la main, car la collection est composée de centaines de fragments.
L’objectif de ce travail est ainsi de calculer des suggestions d’appairages de fragments aux papyrologues afin d’accélérer le processus de reconstruction.
Nous proposons une approche basée sur des patchs utilisant des réseaux de neurones siamois profonds pour calculer un score de similarité entre deux fragments de papyrus.
La difficulté d’obtenir des données annotées en grande quantité rend difficile la construction d’un modèle fonctionnant sur différents types de documents.
Pour cela, nous proposons une méthodologie d’apprentissage auto-supervisée exploitant la structure intrinsèque des documents.
Cette méthode permet d’entraîner des réseaux de neurones siamois profonds sans avoir besoin de données annotées.
Nous avons aussi constitué une base de données prête à l’emploi basée sur la collection de papyrus de l’Université du Michigan, que nous avons ouverte à la communauté.

Related Results

Supervised metric learning with generalization guarantees
Supervised metric learning with generalization guarantees
Apprentissage supervisé de métriques avec garanties en généralisation Ces dernières années, l'importance cruciale des métriques en apprentissage automatique a mené ...
Theory and algorithms for learning metrics with controlled behaviour
Theory and algorithms for learning metrics with controlled behaviour
Théorie et algorithmes pour l'apprentissage de métriques à comportement contrôlé De nombreux algorithmes en Apprentissage Automatique utilisent une notion de distan...
Efficient supervised training of shallow and deep temporally-coded spiking neural networks
Efficient supervised training of shallow and deep temporally-coded spiking neural networks
Apprentissage supervisé efficace pour les réseaux de neurones impulsionnels à codage temporel L'informatique neuromorphique avec les réseaux de neurones impulsionne...
Deep Learning-based Methods for Radiotherapy Dose Optimization
Deep Learning-based Methods for Radiotherapy Dose Optimization
Apprentissage profond pour l'optimisation des doses en radiothérapie La radiothérapie est un pilier du traitement moderne du cancer. La simulation de la dose de rad...
Apprentissage profond multimodal appliqué à l'usinage
Apprentissage profond multimodal appliqué à l'usinage
Les techniques axées sur les données ont offert à la technologie de fabrication intelligente des opportunités sans précédent pour assurer la transition vers une productivité basée ...
Recherche par image robuste par apprentissage profond
Recherche par image robuste par apprentissage profond
Cette thèse aborde la problématique de la recherche robuste d'images par apprentissage profond. La recherche par le contenu d'images consiste à trouver des images visuellement simi...
Geometric deep learning for structural bioinformatics
Geometric deep learning for structural bioinformatics
Apprentissage profond géométrique pour la bioinformatique structurale L'apprentissage automatique a permis plusieurs percées dans la gestion des données tabulaires,...
Bridging Deep Learning and Classical Profiled Side-Channel Attacks
Bridging Deep Learning and Classical Profiled Side-Channel Attacks
Rapprochement de l'apprentissage profond et des attaques par canaux auxiliaires Au travers de cette thèse CIFRE, nous cherchons à mieux comprendre l’intérêt d’utili...

Back to Top