Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

Approche hybride pour la reconnaissance automatique de la parole en langue arabe

View through CrossRef
Le développement d'un système de reconnaissance de la parole exige la disponibilité d'une grande quantité de ressources à savoir, grands corpus de texte et de parole, un dictionnaire de prononciation. Néanmoins, ces ressources ne sont pas disponibles directement pour des dialectes arabes. De ce fait, le développement d'un SRAP pour les dialectes arabes se heurte à de multiples difficultés à savoir, l’'abence de grandes quantités de ressources et l'absence d’'une orthographe standard vu que ces dialectes sont parlés et non écrit. Dans cette perspective, les travaux de cette thèse s’intègrent dans le cadre du développement d’un SRAP pour le dialecte tunisien. Une première partie des contributions consiste à développer une variante de CODA (Conventional Orthography for Arabic Dialectal) pour le dialecte tunisien. En fait, cette convention est conçue dans le but de fournir une description détaillée des directives appliquées au dialecte tunisien. Compte tenu des lignes directives de CODA, nous avons constitué notre corpus nommé TARIC : Corpus de l’interaction des chemins de fer de l’arabe tunisien dans le domaine de la SNCFT. Outre ces ressources, le dictionnaire de prononciation s’impose d’une manière indispensable pour le développement d’un SRAP. À ce propos, dans la deuxième partie des contributions, nous visons la création d’un système nommé conversion (Graphème-Phonème) G2P qui permet de générer automatiquement ce dictionnaire phonétique. Toutes ces ressources décrites avant sont utilisées pour adapter un SRAP pour le MSA du laboratoire LIUM au dialecte tunisien dans le domaine de la SNCFT. L’évaluation de notre système donné lieu WER de 22,6% sur l’ensemble de test.
Agence Bibliographique de l'Enseignement Supérieur
Title: Approche hybride pour la reconnaissance automatique de la parole en langue arabe
Description:
Le développement d'un système de reconnaissance de la parole exige la disponibilité d'une grande quantité de ressources à savoir, grands corpus de texte et de parole, un dictionnaire de prononciation.
Néanmoins, ces ressources ne sont pas disponibles directement pour des dialectes arabes.
De ce fait, le développement d'un SRAP pour les dialectes arabes se heurte à de multiples difficultés à savoir, l’'abence de grandes quantités de ressources et l'absence d’'une orthographe standard vu que ces dialectes sont parlés et non écrit.
Dans cette perspective, les travaux de cette thèse s’intègrent dans le cadre du développement d’un SRAP pour le dialecte tunisien.
Une première partie des contributions consiste à développer une variante de CODA (Conventional Orthography for Arabic Dialectal) pour le dialecte tunisien.
En fait, cette convention est conçue dans le but de fournir une description détaillée des directives appliquées au dialecte tunisien.
Compte tenu des lignes directives de CODA, nous avons constitué notre corpus nommé TARIC : Corpus de l’interaction des chemins de fer de l’arabe tunisien dans le domaine de la SNCFT.
Outre ces ressources, le dictionnaire de prononciation s’impose d’une manière indispensable pour le développement d’un SRAP.
À ce propos, dans la deuxième partie des contributions, nous visons la création d’un système nommé conversion (Graphème-Phonème) G2P qui permet de générer automatiquement ce dictionnaire phonétique.
Toutes ces ressources décrites avant sont utilisées pour adapter un SRAP pour le MSA du laboratoire LIUM au dialecte tunisien dans le domaine de la SNCFT.
L’évaluation de notre système donné lieu WER de 22,6% sur l’ensemble de test.

Related Results

Traduction automatique de la parole vers des pictogrammes
Traduction automatique de la parole vers des pictogrammes
La Communication Alternative et Augmentée (CAA) propose des méthodes et des outils pour pallier les déficiences de la production et de la compréhension de la parole. Les pictogramm...
Une approche neuronale pour l’analyse d’opinions en arabe
Une approche neuronale pour l’analyse d’opinions en arabe
Cette thèse s’inscrit dans le cadre de l’analyse d’opinions en arabe. Son objectif consiste à déterminer la polarité globale d’un énoncé textuel donné écrit en Arabe standa...
Hybrid Metrology Applied to dimensional Control in Lithography
Hybrid Metrology Applied to dimensional Control in Lithography
Métrologie Hybride pour le contrôle dimensionnel en lithographie Afin de respecter sa feuille de route, l’industrie du semi conducteur propose des nouvelles générat...
Unsupervised multilingual models of speech representation, an approach inspired by cognitive science
Unsupervised multilingual models of speech representation, an approach inspired by cognitive science
Apprentissage non supervisé de modèles multilingues de représentation de la parole, une approche inspirée des sciences cognitives La parole, qui est essentielle à l...
ԳՐՈՂ, ԺԱՄԱՆԱԿԱՎՐԷՊ ՀԱՄԱՅՆՔ, ԼԵԶՈՒ
ԳՐՈՂ, ԺԱՄԱՆԱԿԱՎՐԷՊ ՀԱՄԱՅՆՔ, ԼԵԶՈՒ
L’oeuvre de Krikor Beledian, sans doute l’auteur le plus important de la littérature arménienne contemporaine, n’a pas bénéficié d’un bon accueil du lectorat et de l’intelligentsia...
L’Apprentissage artificiel pour la fouille de données multilingues : application à la classification automatique des documents arabes
L’Apprentissage artificiel pour la fouille de données multilingues : application à la classification automatique des documents arabes
La classification automatique des documents, une approche issue de l’apprentissage artificiel et de la fouille de textes, s’avère être très efficace pour l’organisation des ressour...

Back to Top