Entrepôts et analyse en ligne de données complexes centrés utilisateur : un nouveau défi - Archive ouverte HAL Accéder directement au contenu
Hdr Année : 2011

User-centric complex data warehouses and on-line analysis

Entrepôts et analyse en ligne de données complexes centrés utilisateur : un nouveau défi

Résumé

The main goal of data warehouses is to facilitate decision making. In order to satisfy the whole analysis needs of the majority of the users, a promising issue consists in integrating a personalization process for OLAP analysis by taking into account user's own knowledge, preferences, needs,... In other words, the objective is to provide a user-centric decision-making system. In this thesis, we aim at proposing novel solutions for user-centric data warehouses. First, we have designed an original approach to achieve a user-driven model evolution that provides answers to personalized analysis needs. Our key idea consists in generating new anlysis axes based on users' knowledge by dynamically extending dimension hierachies or creating new ones. Moreover, to help users to find non expected and pertinent aggregates expressing deep relations within a data warehouse, we propose to combine data mining techniques with OLAP. We have more precisely defined a new roll-up operator based on the K-means clustering method. In addition, we have proposed a framework for mining large databases without size limit in very acceptable processing times. For this end, we have integrated data mining techniques within database management systems (DBMSs) by exploiting only their features. This helps to facilitate the extension of the capabilities of OLAP towards explicative and predictive analysis. To take into account both data sources changes and users requirements evolution, we have designed a user-centric approach for producing OLAP data cubes on the fly. This is based on a mediation system using ontologies. To generate the global merged ontology from local ontologies, we use the agglomerative hierarchical clustering method. Int the other hand, to warehouse complex data, we have designed a complex object-based multidimensional model. This is defined at two layers: (1) the package diagram layer which describes complex objects and their complex relationships and (2) the class diagram layer which provides details about the structure of each complex object. From the complex object-based multidimensional model, personalized complex object cubes can be derived. Eventually, for evaluationg our user-centric data warehouses solutions, we have implemented and carried out some experiments in both the contexts of relational and XML data warehouses.
Les entrepôts de données répondent à un réel besoin en matière d'accès à l'information résumée. Cependant, en suivant le processus classique d'entreposage et d'analyse en ligne (OLAP) de données, les systèmes d'information décisionnels (SID) exploitent très peu le contenu informationnel des données. Alors même que les SID sont censés être centrés utilisateur, l'OLAP classique ne dispose pas d'outils permettant de guider l'utilisateur vers les faits les plus intéressants du cube. La prise en compte de l'utilisateur dans les SID est une problématique nouvelle, connue sous le nom de personnalisation, qui pose plusieurs enjeux peu ou pas étudiés. Le travail présenté dans ce mémoire vise à proposer des solutions innovantes dans le domaine de la personnalisation dans les entrepôts de données complexes. L'originalité de nos travaux de recherche a consisté à montrer qu'il est pertinent d'intégrer la sémantique dans tout le processus d'entreposage, soit en invitant l'utilisateur à exprimer ses propres connaissances métier, soit en utilisant les méthodes de fouille de données pour extraire des connaissances cachées. En s'appuyant sur l'intuition que des connaissances sur le métier, sur les données entreposées et leur usage (requêtes) peuvent contribuer à aider l'utilisateur dans son exploration et sa navigation dans les données, nous avons proposé une première approche de personnalisation basée sur les connaissances explicites des utilisateurs. En empruntant le concept d'évolution de schéma, nous avons relâché la contrainte du schéma fixe de l'entrepôt, pour permettre d'ajouter ou de supprimer un niveau de hiérarchie dans une dimension. Ces travaux ont été étendus pour recommander à l'utilisateur des hiérarchies de dimension nouvelles basées sur la découverte de nouvelles structures naturelles grâce aux principes d'une méthode de classification (K-means). Nous avons par ailleurs développé la fouille en ligne en s'appuyant uniquement sur les outils offerts par les systèmes de gestion de bases de données (SGBD). La fouille en ligne permet d'étendre les capacités analytiques des SGBD, support des entrepôts de données, de l'OLAP vers une analyse structurante, explicative et prédictive ; et venir en appui à la personnalisation. Afin de prendre en compte à la fois l'évolution des données et celle des besoins tout en garantissant l'intégration structurelle et sémantique des données, nous avons proposé une approche d'analyse en ligne à la demande, qui s'appuie sur un système de médiation à base d'ontologies. Par ailleurs, nous avons proposé un modèle multidimensionnel d'objets complexes basé sur le paradigme objet qui permet de représenter les objets de l'univers de façon plus naturelle et de capter la sémantique qu'ils véhiculent. Un opérateur de projection cubique est alors proposé pour permettre à l'utilisateur de créer des cubes d'objets complexes personnalisés. Toutes nos solutions ont été développées et testées dans le contexte des entrepôts de données relationnels et/ou XML.
Fichier principal
Vignette du fichier
FB_HDR.pdf (2.41 Mo) Télécharger le fichier
Loading...

Dates et versions

tel-00752126 , version 1 (14-11-2012)

Identifiants

  • HAL Id : tel-00752126 , version 1

Citer

Fadila Bentayeb. Entrepôts et analyse en ligne de données complexes centrés utilisateur : un nouveau défi. Base de données [cs.DB]. Université Lumière - Lyon II, 2011. ⟨tel-00752126⟩
727 Consultations
3118 Téléchargements

Partager

Gmail Facebook X LinkedIn More