Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

Construction semi-automatique d'une grammaire d'arbres adjoints pour l'analyse syntaxico-sémantique de l'arabe

View through CrossRef
Cette thèse traite de la description formelle et du développement d’une grammaire électronique de la langue arabe. Ce travail est un prérequis à la création d’outils de traitement automatique de l’arabe. Cette langue présente de nombreux défis pour un traitement automatique. En effet l’ordre de mots en arabe est relativement libre, la morphologie y est riche et les diacritiques sont omis dans les textes écrits. Bien que plusieurs travaux de recherche aient abordé certaines de ces problématiques, les ressources électroniques utiles pour le traitement de l’arabe demeurent relativement rares ou encore peu disponibles. Dans ce travail de thèse, nous nous sommes intéressés à la représentation de la syntaxe (ordre des mots) et du sens de l’arabe standard moderne. Comme système formel de représentation de la langue, nous avons choisi le formalisme des grammaires d’arbres adjoints (Tree Adjoining Grammar). Nous avons ainsi proposé une grammaire d’arbres adjoints électronique de l’arabe nommée «ArabTAG V2.0». Cette ressource réutilise en partie la modélisation préexistante dans la grammaire définie manuellement «ArabTAG» et l’intègre à une représentation abstraite appelée méta-grammaire. L’expert linguiste peut ainsi décrire la syntaxe et sémantique de la langue avec des outils d’abstraction facilitant la maintenance et l’extension de la grammaire. La grammaire ainsi décrite compte 1074 règles syntaxiques (non lexicalisées) et 27 cadres sémantiques (relations prédicatives). Cette ressource a été évaluée en analysant un corpus issu d’extraits d’un manuel scolaire d’apprentissage de l’arabe.
Agence Bibliographique de l'Enseignement Supérieur
Title: Construction semi-automatique d'une grammaire d'arbres adjoints pour l'analyse syntaxico-sémantique de l'arabe
Description:
Cette thèse traite de la description formelle et du développement d’une grammaire électronique de la langue arabe.
Ce travail est un prérequis à la création d’outils de traitement automatique de l’arabe.
Cette langue présente de nombreux défis pour un traitement automatique.
En effet l’ordre de mots en arabe est relativement libre, la morphologie y est riche et les diacritiques sont omis dans les textes écrits.
Bien que plusieurs travaux de recherche aient abordé certaines de ces problématiques, les ressources électroniques utiles pour le traitement de l’arabe demeurent relativement rares ou encore peu disponibles.
Dans ce travail de thèse, nous nous sommes intéressés à la représentation de la syntaxe (ordre des mots) et du sens de l’arabe standard moderne.
Comme système formel de représentation de la langue, nous avons choisi le formalisme des grammaires d’arbres adjoints (Tree Adjoining Grammar).
Nous avons ainsi proposé une grammaire d’arbres adjoints électronique de l’arabe nommée «ArabTAG V2.
0».
Cette ressource réutilise en partie la modélisation préexistante dans la grammaire définie manuellement «ArabTAG» et l’intègre à une représentation abstraite appelée méta-grammaire.
L’expert linguiste peut ainsi décrire la syntaxe et sémantique de la langue avec des outils d’abstraction facilitant la maintenance et l’extension de la grammaire.
La grammaire ainsi décrite compte 1074 règles syntaxiques (non lexicalisées) et 27 cadres sémantiques (relations prédicatives).
Cette ressource a été évaluée en analysant un corpus issu d’extraits d’un manuel scolaire d’apprentissage de l’arabe.

Related Results

Certified semantics and analysis of JavaScript
Certified semantics and analysis of JavaScript
Sémantique et analyse certifiée de JavaScript JavaScript est un langage de programmation maintenant très utilisé - y compris dans des domaines où la sécurité est im...
L’Apprentissage artificiel pour la fouille de données multilingues : application à la classification automatique des documents arabes
L’Apprentissage artificiel pour la fouille de données multilingues : application à la classification automatique des documents arabes
La classification automatique des documents, une approche issue de l’apprentissage artificiel et de la fouille de textes, s’avère être très efficace pour l’organisation des ressour...
Effet du recyclage de l'azote sur la coexistence entre les herbes et arbres en savane
Effet du recyclage de l'azote sur la coexistence entre les herbes et arbres en savane
Les savanes sont caractérisées par la coexistence de deux types de plantes complètement différentes, les herbes et les arbres. Bien que la coexistence de plusieurs espèces soit ass...
Combinatorics of trees under increasing labellings : asymptotics, bijections and algorithms
Combinatorics of trees under increasing labellings : asymptotics, bijections and algorithms
Combinatoire des arbres sous étiquetages croissants : Asymptotiques, bijections et algorithmes Dans cette thèse nous étudions des classes d’arbres étiquetés selon d...
Towards a chronology of life using Lateral Gene Transfers
Towards a chronology of life using Lateral Gene Transfers
Utilisation des transferts horizontaux de gènes pour dater des phylogénies Le fait d'avoir une généalogie datée des organismes vivants est l'un des principaux objec...
Numéro 92 - novembre 2011
Numéro 92 - novembre 2011
L’année 2011 aura été marquée par une vague de changements sans précédents dans le monde arabe : qui aurait pu croire il y a encore quelques mois à l’effondrement de régimes aussi ...
Opétopes : aspects syntaxiques et algébriques
Opétopes : aspects syntaxiques et algébriques
Les opétopes sont des formes (tout comme les globes, les cubes, les simplex, les dendrex, etc.) inventées par Baez et Dolan afin de pouvoir décrire les cellules de cohérence des ca...

Back to Top