Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

Interrogation des sources de données hétérogènes : une approche pour l'analyse des requêtes

View through CrossRef
Le volume des données structurées produites devient de plus en plus considérable. Plusieurs aspects concourent à l’accroissement du volume de données structurées. Au niveau du Web, le Web de données (Linked Data) a permis l’interconnexion de plusieurs jeux de données disponibles créant un gigantesque hub de données. Certaines applications comme l’extraction d’informations produisent des données pour peupler des ontologies. Les capteurs et appareils (ordinateur, smartphone, tablette) connectés produisent de plus en plus de données. Les systèmes d’information d’entreprise sont également affectés. Accéder à une information précise devient de plus en plus difficile. En entreprise, des outils de recherche ont été mis au point pour réduire la charge de travail liée à la recherche d’informations, mais ces outils génèrent toujours des volumes importants. Les interfaces en langage naturel issues du Traitement Automatique des Langues peuvent être mises à contribution pour permettre aux utilisateurs d’exprimer naturellement leurs besoins en informations sans se préoccuper des aspects techniques liés à l’interrogation des données structurées. Les interfaces en langage naturel permettent également d’avoir une réponse concise sans avoir besoin de fouiller d’avantage dans une liste de documents. Cependant actuellement, ces interfaces ne sont pas assez robustes pour être utilisées par le grand public ou pour répondre aux problèmes de l’hétérogénéité ou du volume de données. Nous nous intéressons à la robustesse de ces systèmes du point de vue de l’analyse de la question. La compréhension de la question de l’utilisateur est une étape importante pour retrouver la réponse. Nous proposons trois niveaux d’interprétation pour l’analyse d’une question : domaine abstrait, domaine concret et la relation domaine abstrait/concret. Le domaine abstrait s’intéresse aux données qui sont indépendantes de la nature des jeux de données. Il s’agit principalement des données de mesures. L’interprétation s’appuie sur la logique propre à ces mesures. Le plus souvent cette logique a été bien décrite dans les autres disciplines, mais la manière dont elle se manifeste en langage naturel n’a pas fait l’objet d’une large investigation pour les interfaces en langage naturel basées sur des données structurées. Le domaine concret couvre le domaine métier de l’application. Il s’agit de bien interpréter la logique métier. Pour une base de données, il correspond au niveau applicatif (par opposition à la couche des données). La plupart des interfaces en langage naturel se focalisent principalement sur la couche des données. La relation domaine abstrait/concret s’intéresse aux interprétations qui chevauchent les deux domaines. Du fait de l’importance de l’analyse linguistique, nous avons développé l’infrastructure pour mener cette analyse. L’essentiel des interfaces en langage naturel qui tentent de répondre aux problématiques du Web de données (Linked Data) ont été développées jusqu’ici pour la langue anglaise et allemande. Notre interface tente d’abord de répondre à des questions en français
Agence Bibliographique de l'Enseignement Supérieur
Title: Interrogation des sources de données hétérogènes : une approche pour l'analyse des requêtes
Description:
Le volume des données structurées produites devient de plus en plus considérable.
Plusieurs aspects concourent à l’accroissement du volume de données structurées.
Au niveau du Web, le Web de données (Linked Data) a permis l’interconnexion de plusieurs jeux de données disponibles créant un gigantesque hub de données.
Certaines applications comme l’extraction d’informations produisent des données pour peupler des ontologies.
Les capteurs et appareils (ordinateur, smartphone, tablette) connectés produisent de plus en plus de données.
Les systèmes d’information d’entreprise sont également affectés.
Accéder à une information précise devient de plus en plus difficile.
En entreprise, des outils de recherche ont été mis au point pour réduire la charge de travail liée à la recherche d’informations, mais ces outils génèrent toujours des volumes importants.
Les interfaces en langage naturel issues du Traitement Automatique des Langues peuvent être mises à contribution pour permettre aux utilisateurs d’exprimer naturellement leurs besoins en informations sans se préoccuper des aspects techniques liés à l’interrogation des données structurées.
Les interfaces en langage naturel permettent également d’avoir une réponse concise sans avoir besoin de fouiller d’avantage dans une liste de documents.
Cependant actuellement, ces interfaces ne sont pas assez robustes pour être utilisées par le grand public ou pour répondre aux problèmes de l’hétérogénéité ou du volume de données.
Nous nous intéressons à la robustesse de ces systèmes du point de vue de l’analyse de la question.
La compréhension de la question de l’utilisateur est une étape importante pour retrouver la réponse.
Nous proposons trois niveaux d’interprétation pour l’analyse d’une question : domaine abstrait, domaine concret et la relation domaine abstrait/concret.
Le domaine abstrait s’intéresse aux données qui sont indépendantes de la nature des jeux de données.
Il s’agit principalement des données de mesures.
L’interprétation s’appuie sur la logique propre à ces mesures.
Le plus souvent cette logique a été bien décrite dans les autres disciplines, mais la manière dont elle se manifeste en langage naturel n’a pas fait l’objet d’une large investigation pour les interfaces en langage naturel basées sur des données structurées.
Le domaine concret couvre le domaine métier de l’application.
Il s’agit de bien interpréter la logique métier.
Pour une base de données, il correspond au niveau applicatif (par opposition à la couche des données).
La plupart des interfaces en langage naturel se focalisent principalement sur la couche des données.
La relation domaine abstrait/concret s’intéresse aux interprétations qui chevauchent les deux domaines.
Du fait de l’importance de l’analyse linguistique, nous avons développé l’infrastructure pour mener cette analyse.
L’essentiel des interfaces en langage naturel qui tentent de répondre aux problématiques du Web de données (Linked Data) ont été développées jusqu’ici pour la langue anglaise et allemande.
Notre interface tente d’abord de répondre à des questions en français.

Related Results

Physical database design in document stores
Physical database design in document stores
NoSQL is an umbrella term used to classify alternate storage systems to the traditional Relational Database Management Systems (RDBMSs). Among these, Document stores have gained po...
Anthropologie et archéologie
Anthropologie et archéologie
Les parcours sinueux qu’ont suivis l’anthropologie et l’archéologie en Amérique du Nord depuis une cinquantaine d’années démontrent des intérêts convergents pour la connaissance et...
Querying heterogeneous data in NoSQL document stores
Querying heterogeneous data in NoSQL document stores
Interrogation de données hétérogènes dans les bases de données orientées documents La problématique de cette thèse porte sur l'interrogation de données hétérogènes ...
Optimizing similarity queries in metric spaces meeting user's expectation
Optimizing similarity queries in metric spaces meeting user's expectation
Optimisation des requêtes de similarité dans les espaces métriques répondant aux besoins des usagers La complexité des données contenues dans les grandes bases de d...
Trust evaluation for stream data services based on data quality and service performance
Trust evaluation for stream data services based on data quality and service performance
Évaluation de la fiabilité des services de flux données en se basant sur la qualité de données et la performance du service Ces dernières années ont été marquées pa...
Recommandation de placement de données pour les traitements dans des lacs de données Smartgrids
Recommandation de placement de données pour les traitements dans des lacs de données Smartgrids
Cette thèse porte sur l’optimisation de l’accès aux masses de données générées et/ou exploitées dans la gestion des réseaux de distribution électriques intelligents ou smart grids....
Metadata-driven data integration
Metadata-driven data integration
Data has an undoubtable impact on society. Storing and processing large amounts of available data is currently one of the key success factors for an organization. Nonetheless, we a...

Back to Top