Javascript must be enabled to continue!
Vision-based human gestures recognition for human-robot interaction
View through CrossRef
Reconnaissance des gestes humains basée sur la vision pour l’interaction homme-robot
Dans la perspective des usines du futur, pour garantir une interaction productive, sure et efficace entre l’homme et le robot, il est impératif que le robot puisse interpréter l’information fournie par le collaborateur humain. Pour traiter cette problématique nous avons exploré des solutions basées sur l’apprentissage profond et avons développé un framework pour la détection de gestes humains. Le framework proposé permet une détection robuste des gestes statiques de la main et des gestes dynamiques de la partie supérieure du corps.Pour la détection des gestes statiques de la main, openpose est associé à la caméra Kinect V2 afin d’obtenir un pseudo-squelette humain en 3D. Avec la participation de 10 volontaires, nous avons constitué une base de données d’images, opensign, qui comprend les images RGB et de profondeur de la Kinect V2 correspondant à 10 gestes alphanumériques statiques de la main, issus de l’American Sign Language. Un réseau de neurones convolutifs de type « Inception V3 » est adapté et entrainé à détecter des gestes statiques de la main en temps réel.Ce framework de détection des gestes est ensuite étendu pour permettre la reconnaissance des gestes dynamiques. Nous avons proposé une stratégie de détection de gestes dynamiques basée sur un mécanisme d’attention spatiale. Celle-ci utilise un réseau profond de type « Convolutional Neural Network - Long Short-Term Memory » pour l’extraction des dépendances spatio-temporelles dans des séquences vidéo pur RGB. Les blocs de construction du réseau de neurones convolutifs sont pré-entrainés sur notre base de données opensign de gestes statiques de la main, ce qui permet une extraction efficace des caractéristiques de la main. Un module d’attention spatiale exploite la posture 2D de la partie supérieure du corps pour estimer, d’une part, la distance entre la personne et le capteur pour la normalisation de l’échelle et d’autre part, les paramètres des cadres délimitant les mains du sujet sans avoir recourt à un capteur de profondeur. Ainsi, le module d’attention spatiale se focalise sur les grands mouvements des membres supérieurs mais également sur les images des mains, afin de traiter les petits mouvements de la main et des doigts pour mieux distinguer les classes de gestes. Les informations extraites d’une caméra de profondeur sont acquises de la base de données opensign. Par conséquent, la stratégie proposée pour la reconnaissance des gestes peut être adoptée par tout système muni d’une caméra de profondeur.Ensuite, nous explorons brièvement les stratégies d’estimation de postures 3D à l’aide de caméras monoculaires. Nous proposons d’estimer les postures 3D chez l’homme par une approche hybride qui combine les avantages des estimateurs discriminants de postures 2D avec les approches utilisant des modèles génératifs. Notre stratégie optimise une fonction de coût en minimisant l’écart entre la position et l’échelle normalisée de la posture 2D obtenue à l’aide d’openpose, et la projection 2D virtuelle du modèle cinématique du sujet humain.Pour l’interaction homme-robot en temps réel, nous avons développé un système distribué asynchrone afin d’associer notre module de détection de gestes statiques à une librairie consacrée à l’interaction physique homme-robot OpenPHRI. Nous validons la performance de notre framework grâce à une expérimentation de type « apprentissage par démonstration » avec un bras robotique.
Title: Vision-based human gestures recognition for human-robot interaction
Description:
Reconnaissance des gestes humains basée sur la vision pour l’interaction homme-robot
Dans la perspective des usines du futur, pour garantir une interaction productive, sure et efficace entre l’homme et le robot, il est impératif que le robot puisse interpréter l’information fournie par le collaborateur humain.
Pour traiter cette problématique nous avons exploré des solutions basées sur l’apprentissage profond et avons développé un framework pour la détection de gestes humains.
Le framework proposé permet une détection robuste des gestes statiques de la main et des gestes dynamiques de la partie supérieure du corps.
Pour la détection des gestes statiques de la main, openpose est associé à la caméra Kinect V2 afin d’obtenir un pseudo-squelette humain en 3D.
Avec la participation de 10 volontaires, nous avons constitué une base de données d’images, opensign, qui comprend les images RGB et de profondeur de la Kinect V2 correspondant à 10 gestes alphanumériques statiques de la main, issus de l’American Sign Language.
Un réseau de neurones convolutifs de type « Inception V3 » est adapté et entrainé à détecter des gestes statiques de la main en temps réel.
Ce framework de détection des gestes est ensuite étendu pour permettre la reconnaissance des gestes dynamiques.
Nous avons proposé une stratégie de détection de gestes dynamiques basée sur un mécanisme d’attention spatiale.
Celle-ci utilise un réseau profond de type « Convolutional Neural Network - Long Short-Term Memory » pour l’extraction des dépendances spatio-temporelles dans des séquences vidéo pur RGB.
Les blocs de construction du réseau de neurones convolutifs sont pré-entrainés sur notre base de données opensign de gestes statiques de la main, ce qui permet une extraction efficace des caractéristiques de la main.
Un module d’attention spatiale exploite la posture 2D de la partie supérieure du corps pour estimer, d’une part, la distance entre la personne et le capteur pour la normalisation de l’échelle et d’autre part, les paramètres des cadres délimitant les mains du sujet sans avoir recourt à un capteur de profondeur.
Ainsi, le module d’attention spatiale se focalise sur les grands mouvements des membres supérieurs mais également sur les images des mains, afin de traiter les petits mouvements de la main et des doigts pour mieux distinguer les classes de gestes.
Les informations extraites d’une caméra de profondeur sont acquises de la base de données opensign.
Par conséquent, la stratégie proposée pour la reconnaissance des gestes peut être adoptée par tout système muni d’une caméra de profondeur.
Ensuite, nous explorons brièvement les stratégies d’estimation de postures 3D à l’aide de caméras monoculaires.
Nous proposons d’estimer les postures 3D chez l’homme par une approche hybride qui combine les avantages des estimateurs discriminants de postures 2D avec les approches utilisant des modèles génératifs.
Notre stratégie optimise une fonction de coût en minimisant l’écart entre la position et l’échelle normalisée de la posture 2D obtenue à l’aide d’openpose, et la projection 2D virtuelle du modèle cinématique du sujet humain.
Pour l’interaction homme-robot en temps réel, nous avons développé un système distribué asynchrone afin d’associer notre module de détection de gestes statiques à une librairie consacrée à l’interaction physique homme-robot OpenPHRI.
Nous validons la performance de notre framework grâce à une expérimentation de type « apprentissage par démonstration » avec un bras robotique.
Related Results
Designing a robot to evaluate group formations
Designing a robot to evaluate group formations
Robots are making their way in environments inhabited by people. Whether in domestic or public crowded environments, robots should take into consideration social norms and behavior...
Gestures as Scaffolding to Learn Vocabulary in a Foreign Language
Gestures as Scaffolding to Learn Vocabulary in a Foreign Language
This review paper investigates the influence of gestures on foreign language (FL) vocabulary learning through a series of experiments conducted in our laboratory. The manipulation ...
Teachers’ Gestures in EFL Classroom
Teachers’ Gestures in EFL Classroom
The research analyzed the teachers’ gestures in EFL classrooms. It covered the teachers’ gestures, the functions of the teachers’ gestures, and the effect of the teachers’ gestures...
PELATIHAN PERANCANGAN ROBOT BERODA DENGAN DETEKTOR TEPI MEJA PADA SEKOLAH SMA TARSISIUS 1 DAN SMA TRI RATNA
PELATIHAN PERANCANGAN ROBOT BERODA DENGAN DETEKTOR TEPI MEJA PADA SEKOLAH SMA TARSISIUS 1 DAN SMA TRI RATNA
Wheeled robot is a robot which movement is managed by the rotation of Direct Current (DC) motors. These motors are connected to wheels. Wheeled robot usually is used as a teaching ...
Sistem Kendali Hybrid Fuzzy-Pid pada Kinematika Robot Berkaki 4 Menggunakan Sensor Gyroscope
Sistem Kendali Hybrid Fuzzy-Pid pada Kinematika Robot Berkaki 4 Menggunakan Sensor Gyroscope
<p><em>Legged robots have attracted the attention of researchers because of their superior adaptation to complex environments compared to wheeled robots. Legged robots ...
Le rôle des gestes chez des élèves avec une déficience intellectuelle dans la réalisation, la conceptualisation et l’explicitation d’une tâche de rotation mentale : Résultats de trois revues systématiques de littérature et d’une recherche empirique
Le rôle des gestes chez des élèves avec une déficience intellectuelle dans la réalisation, la conceptualisation et l’explicitation d’une tâche de rotation mentale : Résultats de trois revues systématiques de littérature et d’une recherche empirique
Cette thèse analyse le rôle des gestes dans une tâche de rotation mentale chez des élèves avec une déficience intellectuelle (DI). La partie théorique définit les gestes et leurs r...
Cooperative social robots: accompanying, guiding and interacting with people
Cooperative social robots: accompanying, guiding and interacting with people
The development of social robots capable of interacting with humans is one of the principal challenges in the field of robotics. More and more, robots are appearing in dynamic envi...
Depth-aware salient object segmentation
Depth-aware salient object segmentation
Object segmentation is an important task which is widely employed in many computer vision applications such as object detection, tracking, recognition, and ret...

