Javascript must be enabled to continue!
Catégorisation sémantique et information grammaticale en arabe
View through CrossRef
La problématique centrale de ce travail porte sur la catégorisation sémantique non supervisée de mots en arabe basée sur de grands corpus, et tout particulièrement sur l’utilité de l’information grammaticale dans cette catégorisation sémantique. Cette thèse a été entamée pour mener à bien la mise en place d’une méthodologie rigoureuse pour tester l’apport de la structure grammaticale à la catégorisation sémantique et pour l’appliquer sur un grand corpus de quelques milliards de mots.Extraire la structure grammaticale d’un corpus sans connaissance préalable sur la langue se fait ici en étudiant la distribution des patterns constitués par les éléments de haute fréquence au voisinage des éléments de moindre fréquence. Si le corpus est assez grand, les éléments de haute fréquence sont des éléments jouant un rôle structurant dans la phrase ou le document, comme les mots grammaticaux. L’enjeu de cette recherche est conséquent : si l’hypothèse est vérifiée, il sera possible de compléter les ressources sémantiques d’une manière automatisée. Notre modèle se veut indépendant de la langue et minimisant au maximum les interactions avec l’utilisateur, depuis la constitution du corpus jusqu’à l’évaluation des résultats.Notre thèse montre que, l’information grammaticale apporte de l’information sémantique et qu’il est probablement dommage qu’elle ne soit pas plus utilisée dans les recherches sur la sémantique des mots, et que nous avons au passage fait un ensemble d’observations dont nous espérons qu’elles seront utiles aux futures recherches sur le domaine.
Title: Catégorisation sémantique et information grammaticale en arabe
Description:
La problématique centrale de ce travail porte sur la catégorisation sémantique non supervisée de mots en arabe basée sur de grands corpus, et tout particulièrement sur l’utilité de l’information grammaticale dans cette catégorisation sémantique.
Cette thèse a été entamée pour mener à bien la mise en place d’une méthodologie rigoureuse pour tester l’apport de la structure grammaticale à la catégorisation sémantique et pour l’appliquer sur un grand corpus de quelques milliards de mots.
Extraire la structure grammaticale d’un corpus sans connaissance préalable sur la langue se fait ici en étudiant la distribution des patterns constitués par les éléments de haute fréquence au voisinage des éléments de moindre fréquence.
Si le corpus est assez grand, les éléments de haute fréquence sont des éléments jouant un rôle structurant dans la phrase ou le document, comme les mots grammaticaux.
L’enjeu de cette recherche est conséquent : si l’hypothèse est vérifiée, il sera possible de compléter les ressources sémantiques d’une manière automatisée.
Notre modèle se veut indépendant de la langue et minimisant au maximum les interactions avec l’utilisateur, depuis la constitution du corpus jusqu’à l’évaluation des résultats.
Notre thèse montre que, l’information grammaticale apporte de l’information sémantique et qu’il est probablement dommage qu’elle ne soit pas plus utilisée dans les recherches sur la sémantique des mots, et que nous avons au passage fait un ensemble d’observations dont nous espérons qu’elles seront utiles aux futures recherches sur le domaine.
Related Results
Certified semantics and analysis of JavaScript
Certified semantics and analysis of JavaScript
Sémantique et analyse certifiée de JavaScript
JavaScript est un langage de programmation maintenant très utilisé - y compris dans des domaines où la sécurité est im...
The making of immigrant clients; An ethnographic study of categorisation work in the Norwegian Labour and Welfare Administration (NAV)
The making of immigrant clients; An ethnographic study of categorisation work in the Norwegian Labour and Welfare Administration (NAV)
In this study, I contribute to our understanding of the welfare services provided to immigrants. How street-level bureaucrats make sense of and categorise immigrant clients determi...
Efficacité des manuels scolaires dans l’acquisition et la maitrise de la lecture sémantique en arabe langue étrangère : diagnostic et orientations pédagogiques avec la réalisation de corpus
Efficacité des manuels scolaires dans l’acquisition et la maitrise de la lecture sémantique en arabe langue étrangère : diagnostic et orientations pédagogiques avec la réalisation de corpus
Si nous prenons littéralement la définition : "lire, c’est comprendre", la compréhension devient la seule mesure significative à considérer lorsque nous évaluons la lecture d’un te...
Computer-Mediated Chat
Computer-Mediated Chat
The technical apparatus is, then, being made at home with the rest of our world. And that's a thing that's routinely being done, and it's the source of the failure of technocratic ...
Etude des bases neurales de la catégorisation chez les sujets sains et les patients cérébro-lésés
Etude des bases neurales de la catégorisation chez les sujets sains et les patients cérébro-lésés
La catégorisation est un ensemble d’opérations mentales qui permettent de classer les objets et les évènements. C’est un processus crucial pour de nombreuses situations, telles que...
Tintin in the Arab World and Arabic in the World of Tintin
Tintin in the Arab World and Arabic in the World of Tintin
Les aventures de Tintin d’après Hergé ont été traduites en plus de 80 langues et dialectes, dont l’arabe. Cependant, une seule des histoires ou Tintin voyage dans le monde arabe fu...
La prédication de second ordre : l’expression de la cause et de la finalité, en arabe contemporain.
La prédication de second ordre : l’expression de la cause et de la finalité, en arabe contemporain.
Notre Travail s’inscrit dans le cadre théorique du traitement informatique des langues, élaboré et développé au sein du laboratoire Lexiques, Dictionnaires, Informatique (LDI), à l...
Over‐Triage in Casevac Categorisation is Common in Hong Kong
Over‐Triage in Casevac Categorisation is Common in Hong Kong
ObjectiveTo review the categorisation of patients who were transferred out from out‐lying islands to urban hospitals utilising casualty evacuation (CASEVAC), and to search for poss...

