Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

Recherche par image robuste par apprentissage profond

View through CrossRef
Cette thèse aborde la problématique de la recherche robuste d'images par apprentissage profond. La recherche par le contenu d'images consiste à trouver des images visuellement similaires à une image "requête" dans de grandes bases de données. Les approches par apprentissage profond sont basées sur l'apprentissage de représentations des images afin de mesurer leur similarité, par exemple, avec la distance euclidienne. La recherche d'images est notamment utilisée dans les moteurs de recherche, tels qu'Acsepto, le moteur de recherche de logos de marques déposées développé par Coexya. Cette thèse vise à améliorer les performances et la fiabilité des systèmes de recherche d'images. À cette fin, nous explorons la robustesse dans l'apprentissage profond selon trois perspectives. Nous exposons d'abord les difficultés qui se présentent lors de l'optimisation des métriques d'évaluation utilisées en recherche d'images, telles que la Précision Moyenne (AP) et le rappel à k, à savoir la non-différentiabilité et la non-décomposabilité. Elles rendent ces métriques difficilement optimisables par descente de gradient stochastique. Il est ainsi nécessaire d'utiliser des fonctions de coût de substitution pour entraîner les réseaux de neurones profonds (DNN), ce qui induit une disparité entre l'objectif d'entraînement et les métriques d'évaluation. Pour réduire cet écart, nous introduisons une famille de fonctions de coût différentiables qui sont des bornes supérieures des métriques d'évaluation usuelles et incluent un objectif explicite de décomposabilité. Cette famille permet d’optimiser plusieurs métriques d'évaluation, telles que l’AP, le rappel à k et le NDCG. Cette approche, appelée ROADMAP, surpasse les fonctions de coût de l'état de l'art sur plusieurs bases de données de recherche d'images. Ensuite, nous cherchons à réduire la gravité des erreurs commises par les systèmes de recherche d'images basés apprentissage profonds. En effet, les réseaux de neurones, lorsqu'ils ne sont pas contraints, ont tendance à commettre des erreurs sévères, qui sont difficilement compréhensibles par les humains. Ces erreurs graves peuvent réduire la confiance des utilisateurs dans les moteurs de recherche. Nous proposons une solution en exploitant les relations hiérarchiques entre les catégories d'images. En effet, les relations sémantiques peuvent servir de proxy pour la façon dont les humains jugent la gravité d'une erreur. Ces relations sont intégrées dans une nouvelle extension de l’AP au cadre hiérarchique, H-AP. Nous définissons ensuite HAPPIER, une fonction de coût différentiable optimisant H-AP, construite similairement à ROADMAP. Nous montrons quantitativement et qualitativement que les réseaux de neurones entraînés avec HAPPIER produisent des classements avec des erreurs moins sévères et se rapprochent davantage de la sémantique des ensembles de données. Enfin, nous abordons les capacités de détection d’exemples hors distribution (OOD) des DNN. Il s'agit de détecter des données qui ne devraient pas être traitées par les DNN, par exemple, des images de catégories qui n'ont pas été vues pendant l'entraînement. Nous introduisons HEAT, une nouvelle méthode de détection d’OOD. HEAT est une méthode post-hoc, ce qui la rend applicable à potentiellement toutes les architectures pré-entraînées, sans nécessité de les affiner. Nous proposons d'utiliser les modèles à énergie pour raffiner les méthodes de la littérature, en apprenant un terme résiduel pour améliorer leur expressivité. Nous exploitons ensuite leurs différents biais de modélisation complémentaires en utilisant la composition de fonctions d’énergies pour améliorer les capacités de détection d’OOD des DNN. Nous démontrons quantitativement l'intérêt de ces deux composantes sur trois jeux de données, pour lesquels HEAT surpasse les méthodes de l'état de l'art en détection d'OOD.
Agence Bibliographique de l'Enseignement Supérieur
Title: Recherche par image robuste par apprentissage profond
Description:
Cette thèse aborde la problématique de la recherche robuste d'images par apprentissage profond.
La recherche par le contenu d'images consiste à trouver des images visuellement similaires à une image "requête" dans de grandes bases de données.
Les approches par apprentissage profond sont basées sur l'apprentissage de représentations des images afin de mesurer leur similarité, par exemple, avec la distance euclidienne.
La recherche d'images est notamment utilisée dans les moteurs de recherche, tels qu'Acsepto, le moteur de recherche de logos de marques déposées développé par Coexya.
Cette thèse vise à améliorer les performances et la fiabilité des systèmes de recherche d'images.
À cette fin, nous explorons la robustesse dans l'apprentissage profond selon trois perspectives.
Nous exposons d'abord les difficultés qui se présentent lors de l'optimisation des métriques d'évaluation utilisées en recherche d'images, telles que la Précision Moyenne (AP) et le rappel à k, à savoir la non-différentiabilité et la non-décomposabilité.
Elles rendent ces métriques difficilement optimisables par descente de gradient stochastique.
Il est ainsi nécessaire d'utiliser des fonctions de coût de substitution pour entraîner les réseaux de neurones profonds (DNN), ce qui induit une disparité entre l'objectif d'entraînement et les métriques d'évaluation.
Pour réduire cet écart, nous introduisons une famille de fonctions de coût différentiables qui sont des bornes supérieures des métriques d'évaluation usuelles et incluent un objectif explicite de décomposabilité.
Cette famille permet d’optimiser plusieurs métriques d'évaluation, telles que l’AP, le rappel à k et le NDCG.
Cette approche, appelée ROADMAP, surpasse les fonctions de coût de l'état de l'art sur plusieurs bases de données de recherche d'images.
Ensuite, nous cherchons à réduire la gravité des erreurs commises par les systèmes de recherche d'images basés apprentissage profonds.
En effet, les réseaux de neurones, lorsqu'ils ne sont pas contraints, ont tendance à commettre des erreurs sévères, qui sont difficilement compréhensibles par les humains.
Ces erreurs graves peuvent réduire la confiance des utilisateurs dans les moteurs de recherche.
Nous proposons une solution en exploitant les relations hiérarchiques entre les catégories d'images.
En effet, les relations sémantiques peuvent servir de proxy pour la façon dont les humains jugent la gravité d'une erreur.
Ces relations sont intégrées dans une nouvelle extension de l’AP au cadre hiérarchique, H-AP.
Nous définissons ensuite HAPPIER, une fonction de coût différentiable optimisant H-AP, construite similairement à ROADMAP.
Nous montrons quantitativement et qualitativement que les réseaux de neurones entraînés avec HAPPIER produisent des classements avec des erreurs moins sévères et se rapprochent davantage de la sémantique des ensembles de données.
Enfin, nous abordons les capacités de détection d’exemples hors distribution (OOD) des DNN.
Il s'agit de détecter des données qui ne devraient pas être traitées par les DNN, par exemple, des images de catégories qui n'ont pas été vues pendant l'entraînement.
Nous introduisons HEAT, une nouvelle méthode de détection d’OOD.
HEAT est une méthode post-hoc, ce qui la rend applicable à potentiellement toutes les architectures pré-entraînées, sans nécessité de les affiner.
Nous proposons d'utiliser les modèles à énergie pour raffiner les méthodes de la littérature, en apprenant un terme résiduel pour améliorer leur expressivité.
Nous exploitons ensuite leurs différents biais de modélisation complémentaires en utilisant la composition de fonctions d’énergies pour améliorer les capacités de détection d’OOD des DNN.
Nous démontrons quantitativement l'intérêt de ces deux composantes sur trois jeux de données, pour lesquels HEAT surpasse les méthodes de l'état de l'art en détection d'OOD.

Related Results

Apprentissage profond multimodal appliqué à l'usinage
Apprentissage profond multimodal appliqué à l'usinage
Les techniques axées sur les données ont offert à la technologie de fabrication intelligente des opportunités sans précédent pour assurer la transition vers une productivité basée ...
Deep Learning-based Methods for Radiotherapy Dose Optimization
Deep Learning-based Methods for Radiotherapy Dose Optimization
Apprentissage profond pour l'optimisation des doses en radiothérapie La radiothérapie est un pilier du traitement moderne du cancer. La simulation de la dose de rad...
Geometric deep learning for structural bioinformatics
Geometric deep learning for structural bioinformatics
Apprentissage profond géométrique pour la bioinformatique structurale L'apprentissage automatique a permis plusieurs percées dans la gestion des données tabulaires,...
Meta-reinforcement learning for social robotics.
Meta-reinforcement learning for social robotics.
Méta-apprentissage par renforcement pour la robotique sociale Les systèmes de robotique sociale visent à fournir une assistance, à coopérer, à participer à des tâch...
Robust and Privacy-Preserving Federated Learning
Robust and Privacy-Preserving Federated Learning
Vers un Apprentissage fédéré robuste et préservant la confidentialité Dans le monde numérique en perpétuelle mutation d’aujourd’hui, l’apprentissage automatique est...
Impact de l’utilisation de GeoGebra sur l’apprentissage des élèves : Cas de la compréhension du concept de fonctions numériques au lycée
Impact de l’utilisation de GeoGebra sur l’apprentissage des élèves : Cas de la compréhension du concept de fonctions numériques au lycée
Des recherches sur l’intégration pédagogique des technologies numériques en enseignement – apprentissage en nombre très important ont donné des preuves que l’utilisation des logici...
Trustworthy collaborative learning : Personalization, privacy, and robustness at the edge
Trustworthy collaborative learning : Personalization, privacy, and robustness at the edge
Apprentissage collaboratif de confiance : Personnalisation, confidentialité et cobustesse en environnements décentralisés Il y a une vingtaine d'années, l'émergence...
Learning-based representations and methods for 3D shape analysis, manipulation and reconstruction
Learning-based representations and methods for 3D shape analysis, manipulation and reconstruction
Représentations et méthodes basées sur l’apprentissage pour l’analyse, la manipulation et la reconstruction de formes en 3D Traiter et analyser efficacement les don...

Back to Top