Javascript must be enabled to continue!
Indexation sémantique des images et des vidéos par apprentissage actif
View through CrossRef
Le cadre général de cette thèse est l'indexation sémantique et la recherche d'informations, appliquée à des documents multimédias. Plus précisément, nous nous intéressons à l'indexation sémantique des concepts dans des images et vidéos par les approches d'apprentissage actif, que nous utilisons pour construire des corpus annotés. Tout au long de cette thèse, nous avons montré que les principales difficultés de cette tâche sont souvent liées, en général, à l'fossé sémantique. En outre, elles sont liées au problème de classe-déséquilibre dans les ensembles de données à grande échelle, où les concepts sont pour la plupart rares. Pour l'annotation de corpus, l'objectif principal de l'utilisation de l'apprentissage actif est d'augmenter la performance du système en utilisant que peu d'échantillons annotés que possible, ainsi minimisant les coûts de l'annotations des données (par exemple argent et temps). Dans cette thèse, nous avons contribué à plusieurs niveaux de l'indexation multimédia et nous avons proposé trois approches qui succèdent des systèmes de l'état de l'art: i) l'approche multi-apprenant (ML) qui surmonte le problème de classe-déséquilibre dans les grandes bases de données, ii) une méthode de reclassement qui améliore l'indexation vidéo, iii) nous avons évalué la normalisation en loi de puissance et de l'APC et a montré son efficacité dans l'indexation multimédia. En outre, nous avons proposé l'approche ALML qui combine le multi-apprenant avec l'apprentissage actif, et nous avons également proposé une méthode incrémentale qui accélère l'approche proposé (ALML). En outre, nous avons proposé l'approche de nettoyage actif, qui aborde la qualité des annotations. Les méthodes proposées ont été tous validées par plusieurs expériences, qui ont été menées et évaluées sur des collections à grande échelle de l'indice de benchmark internationale bien connue, appelés TRECVID. Enfin, nous avons présenté notre système d'annotation dans le monde réel basé sur l'apprentissage actif, qui a été utilisé pour mener les annotations de l'ensemble du développement de la campagne TRECVID en 2011, et nous avons présenté notre participation à la tâche d'indexation sémantique de cette campagne, dans laquelle nous nous sommes classés à la 3ème place sur 19 participants.
Title: Indexation sémantique des images et des vidéos par apprentissage actif
Description:
Le cadre général de cette thèse est l'indexation sémantique et la recherche d'informations, appliquée à des documents multimédias.
Plus précisément, nous nous intéressons à l'indexation sémantique des concepts dans des images et vidéos par les approches d'apprentissage actif, que nous utilisons pour construire des corpus annotés.
Tout au long de cette thèse, nous avons montré que les principales difficultés de cette tâche sont souvent liées, en général, à l'fossé sémantique.
En outre, elles sont liées au problème de classe-déséquilibre dans les ensembles de données à grande échelle, où les concepts sont pour la plupart rares.
Pour l'annotation de corpus, l'objectif principal de l'utilisation de l'apprentissage actif est d'augmenter la performance du système en utilisant que peu d'échantillons annotés que possible, ainsi minimisant les coûts de l'annotations des données (par exemple argent et temps).
Dans cette thèse, nous avons contribué à plusieurs niveaux de l'indexation multimédia et nous avons proposé trois approches qui succèdent des systèmes de l'état de l'art: i) l'approche multi-apprenant (ML) qui surmonte le problème de classe-déséquilibre dans les grandes bases de données, ii) une méthode de reclassement qui améliore l'indexation vidéo, iii) nous avons évalué la normalisation en loi de puissance et de l'APC et a montré son efficacité dans l'indexation multimédia.
En outre, nous avons proposé l'approche ALML qui combine le multi-apprenant avec l'apprentissage actif, et nous avons également proposé une méthode incrémentale qui accélère l'approche proposé (ALML).
En outre, nous avons proposé l'approche de nettoyage actif, qui aborde la qualité des annotations.
Les méthodes proposées ont été tous validées par plusieurs expériences, qui ont été menées et évaluées sur des collections à grande échelle de l'indice de benchmark internationale bien connue, appelés TRECVID.
Enfin, nous avons présenté notre système d'annotation dans le monde réel basé sur l'apprentissage actif, qui a été utilisé pour mener les annotations de l'ensemble du développement de la campagne TRECVID en 2011, et nous avons présenté notre participation à la tâche d'indexation sémantique de cette campagne, dans laquelle nous nous sommes classés à la 3ème place sur 19 participants.
Related Results
Numéro 107 - novembre 2013
Numéro 107 - novembre 2013
Il existe en Belgique un débat animé et récurrent à propos du mécanisme d'indexation quasi automatique des salaires. D'un côté, les défenseurs de celui-ci y voient un dispositif es...
Certified semantics and analysis of JavaScript
Certified semantics and analysis of JavaScript
Sémantique et analyse certifiée de JavaScript
JavaScript est un langage de programmation maintenant très utilisé - y compris dans des domaines où la sécurité est im...
Probabilistic graphical models and deep learning methods for remote sensing image analysis
Probabilistic graphical models and deep learning methods for remote sensing image analysis
Modèles de graphes probabilistes et méthodes d'apprentissage profond pour l'analyse d'images de télédétection
Grâce aux avancées actuelles des missions spatiales d'...
Structuration sématique de documents XML centres-documents
Structuration sématique de documents XML centres-documents
La numérisation des documents et le développement des technologies Internet ont engendré une augmentation permanente du nombre de documents et de types de documents disponibles. Fa...
Analyzing Quality of YouTube Videos about Premature Ovarian Failure in the Past Decade
Analyzing Quality of YouTube Videos about Premature Ovarian Failure in the Past Decade
Abstract
Background
To determine the quality of YouTube videos about premature ovarian failure (POF), and variations in quality of professional YouTube videos about POF.
M...
Thyrosonics : learning-based detection and classification of thyroid nodules from ultrasound images
Thyrosonics : learning-based detection and classification of thyroid nodules from ultrasound images
Thyrosonics : l'apprentissage automatique pour la détection et classification des nodules thyroïdiens dans les images échographiques
L'échographie est une technique...
Visual learning in Apis mellifera under virtual reality conditions
Visual learning in Apis mellifera under virtual reality conditions
Apprentissage visuel en réalité virtuelle chez Apis mellifera
Dotées d'un cerveau de moins d'un millimètre cube et contenant environ 950 000 neurones, les abeilles ...
Trustworthy collaborative learning : Personalization, privacy, and robustness at the edge
Trustworthy collaborative learning : Personalization, privacy, and robustness at the edge
Apprentissage collaboratif de confiance : Personnalisation, confidentialité et cobustesse en environnements décentralisés
Il y a une vingtaine d'années, l'émergence...

