5 research outputs found

    Contribution à la définition de modèles de recherche d'information flexibles basés sur les CP-Nets

    Get PDF
    This thesis addresses two main problems in IR: automatic query weighting and document semantic indexing. Our global contribution consists on the definition of a theoretical flexible information retrieval (IR) model based on CP-Nets. The CP-Net formalism is used for the graphical representation of flexible queries expressing qualitative preferences and for automatic weighting of such queries. Furthermore, the CP-Net formalism is used as an indexing language in order to represent document representative concepts and related relations in a roughly compact way. Concepts are identified by projection on WordNet. Concept relations are discovered by means of semantic association rules. A query evaluation mechanism based on CP-Nets graph similarity is also proposed.Ce travail de thèse adresse deux principaux problèmes en recherche d'information : (1) la formalisation automatique des préférences utilisateur, (ou la pondération automatique de requêtes) et (2) l'indexation sémantique. Dans notre première contribution, nous proposons une approche de recherche d'information (RI) flexible fondée sur l'utilisation des CP-Nets (Conditional Preferences Networks). Le formalisme CP-Net est utilisé d'une part, pour la représentation graphique de requêtes flexibles exprimant des préférences qualitatives et d'autre part pour l'évaluation flexible de la pertinence des documents. Pour l'utilisateur, l'expression de préférences qualitatives est plus simple et plus intuitive que la formulation de poids numériques les quantifiant. Cependant, un système automatisé raisonnerait plus simplement sur des poids ordinaux. Nous proposons alors une approche de pondération automatique des requêtes par quantification des CP-Nets correspondants par des valeurs d'utilité. Cette quantification conduit à un UCP-Net qui correspond à une requête booléenne pondérée. Une utilisation des CP-Nets est également proposée pour la représentation des documents dans la perspective d'une évaluation flexible des requêtes ainsi pondéreés. Dans notre seconde contribution, nous proposons une approche d'indexation conceptuelle basée sur les CP-Nets. Nous proposons d'utiliser le formalisme CP-Net comme langage d'indexation afin de représenter les concepts et les relations conditionnelles entre eux d'une manière relativement compacte. Les noeuds du CP-Net sont les concepts représentatifs du contenu du document et les relations entre ces noeuds expriment les associations conditionnelles qui les lient. Notre contribution porte sur un double aspect : d'une part, nous proposons une approche d'extraction des concepts en utilisant WordNet. Les concepts résultants forment les noeuds du CP-Net. D'autre part, nous proposons d'étendre et d'utiliser la technique de règles d'association afin de découvrir les relations conditionnelles entre les concepts noeuds du CP-Nets. Nous proposons enfin un mécanisme d'évaluation des requêtes basé sur l'appariement de graphes (les CP-Nets document et requête en l'occurrence)

    SARIPOD : Système multi-Agent de Recherche Intelligente POssibiliste de Documents Web

    Get PDF
    La présente thèse de doctorat en informatique propose un modèle pour une recherche d'information intelligente possibiliste des documents Web et son implémentation. Ce modèle est à base de deux Réseaux Petits Mondes Hiérarchiques (RPMH) et d'un Réseau Possibiliste (RP) : Le premier RPMH consiste à structurer les documents retrouvés en zones denses de pages Web thématiquement liées les unes aux autres. Nous faisons ainsi apparaître des nuages denses de pages qui traitent d'un sujet et des sujets connexes (assez similaires sémantiquement) et qui répondent toutes fortement à une requête. Le second RPMH est celui qui consiste à ne pas prendre les mots-clés tels quels mais à considérer une requête comme multiple en ce sens qu'on ne cherche pas seulement le mot-clé dans les pages Web mais aussi les substantifs qui lui sont sémantiquement proches. Les Réseaux Possibilistes combinent les deux RPMH afin d'organiser les documents recherchés selon les préférences de l'utilisateur. En effet, l'originalité du modèle proposé se décline selon les trois volets suivants qui synthétisent nos contributions. Le premier volet s'intéresse au processus itératif de la reformulation sémantique de requêtes. Cette technique est à base de relations de dépendance entre les termes de la requête. Nous évaluons notamment les proximités des mots du dictionnaire français « Le Grand Robert » par rapport aux termes de la requête. Ces proximités sont calculées par le biais de notre approche de recherche des composantes de sens dans un RPMH de dictionnaire de mots par application d'une méthode basée sur le dénombrement des circuits dans le réseau. En fait, l'utilisateur du système proposé choisit le nombre de mots sémantiquement proches qu'il désire ajouter à chaque terme de sa requête originelle pour construire sa requête reformulée sémantiquement. Cette dernière représente la première partie de son profil qu'il propose au système. La seconde partie de son profil est constituée des choix des coefficients de pertinence possibilistes affectés aux entités logiques des documents de la collection. Ainsi, notre système tient compte des profils dynamiques des utilisateurs au fur et à mesure que ces derniers utilisent le système. Ce dernier est caractérisé par son intelligence, son adaptativité, sa flexibilité et sa dynamicité. Le second volet consiste à proposer des relations de dépendance entre les documents recherchés dans un cadre ordinal. Ces relations de dépendance entre ces documents traduisent les liens sémantiques ou statistiques évaluant les distributions des termes communs à des paires ou ensembles de documents. Afin de quantifier ces relations, nous nous sommes basés sur les calculs des proximités entres ces documents par application d'une méthode de dénombrement de circuits dans le RPMH de pages Web. En effet, les documents peuvent ainsi être regroupés dans des classes communes (groupes de documents thématiquement proches). Le troisième volet concerne la définition des relations de dépendance, entre les termes de la requête et les documents recherchés, dans un cadre qualitatif. Les valeurs affectées à ces relations traduisent des ordres partiels de préférence. En fait, la théorie des possibilités offre deux cadres de travail : le cadre qualitatif ou ordinal et le cadre quantitatif. Nous avons proposé notre modèle dans un cadre ordinal. Ainsi, des préférences entre les termes de la requête se sont ajoutées à notre modèle de base. Ces préférences permettent de restituer des documents classés par préférence de pertinence. Nous avons mesuré aussi l'apport de ces facteurs de préférence dans l'augmentation des scores de pertinence des documents contenant ces termes dans le but de pénaliser les scores de pertinence des documents ne les contenant pas. Pour la mise en place de ce modèle nous avons choisi les systèmes multi-agents. L'avantage de l'architecture que nous proposons est qu'elle offre un cadre pour une collaboration entre les différents acteurs et la mise en œuvre de toutes les fonctionnalités du système de recherche d'information (SRI). L'architecture s'accorde parfaitement avec le caractère intelligent possibiliste et permet de bénéficier des capacités de synergie inhérente entre les différentes composantes du modèle proposé. Dans le présent travail, nous avons donc pu mettre en exergue à travers les expérimentations effectuées l'intérêt de faire combiner les deux RPMH via un réseau possibiliste dans un SRI, ce qui permet d'enrichir le niveau d'exploration d'une collection. Ce dernier n'est pas limité aux documents mais l'étend en considérant les requêtes. En effet, la phase de reformulation sémantique de requête permet à l'utilisateur de profiter des autres documents correspondants aux termes sémantiquement proches des termes de la requête originelle. Ces documents peuvent exister dans d'autres classes des thèmes. En conséquence, une reclassification proposée par le système s'avère pertinente afin d'adapter les résultats d'une requête aux nouveaux besoins des utilisateurs. ABSTRACT : This Ph.D. thesis proposes a new model for a multiagent possibilistic Web information retrieval and its implementation. This model is based on two Hierarchical Small-Worlds (HSW) Networks and a Possibilistic Networks (PN): The first HSW consists in structuring the founded documents in dense zones of Web pages which strongly depend on each other. We thus reveal dense clouds of pages which "speak" more or less about the same subject and related subjects (semantically similar) and which all strongly answer user's query. The second HSW consists in considering the query as multiple in the sense that we don't seek only the keyword in the Web pages but also its semantically close substantives. The PN generates the mixing of these two HSW in order to organize the searched documents according to user's preferences. Indeed, the originality of the suggested model is declined according to three following shutters' which synthesize our contributions. The first shutter is interested in the iterative process of query semantic reformulation. This technique is based on relationship dependence between query's terms. We evaluate in particular the semantics proximities between the words of the French dictionary "Le Grand Robert" and query's terms. These proximities are calculated via our approach of research of the semantics components in the HSW of dictionary of words by application of our method of enumeration of circuits in the HSW of dictionary. In fact, the user of the suggested system chooses the number of close words that he desire to add to each word of his initial query to build his semantically reformulated query. This one represents the first part of user's profile which he proposes to the system. The second part of its profile makes up of its choices of the coefficients of relevance possibilistic of the logical entities of the documents of the collection. Thus, our system takes account of the dynamic profiles of its users progressively they use the system, which proves its intelligence, its adaptability, its flexibility and its dynamicity. The second shutter consists in proposing relationship dependence between documents of the collection within an ordinal framework. These relationships dependence between these documents represent the semantic or statistical links evaluating the distributions of the general terms to pairs or sets of documents.  In order to quantify these relationships, we are based on the calculations of the proximities between these documents by application of a method enumerating of circuits in the HSW of Web pages. Indeed, the documents can thus be clustered in common classes (groups of close documents). The third shutter is related to the definition of the relationships dependence between query's terms and documents of the collection, within a qualitative framework. The assigned values to these relations translate preferably partial orders. In fact, possibilistic theory offers two working frameworks:  the qualitative or ordinal framework and the numerical framework.  We proposed our model within an ordinal framework. Thus, we add to our basic model preferences between query's terms. These preferences make it possible to restore documents classified by relevance's preference. We also measured the contribution of these preferably factors in the increase of the relevance's scores of  documents containing these terms with an aim of penalizing the relevance's scores of the documents not containing them. For the installation of this model we chose multiagent systems. The advantage of the proposed architecture is that it offers a framework for collaboration between the various actors and the implementation of all the functionalities of the information retrieval system. Architecture agrees perfectly with the possibilistic intelligent character and makes it possible to profit from the capacities of inherent synergy in the suggested model. We thus could put forward, through the carried out experiments, the goal of combining the two HSW via a possibilistic network in an information retrieval system, which makes it possible to enrich the exploration level of a collection. This exploration is not only limited to the documents but it extends by considering also the query. Indeed, the semantic query reformulation phase makes it possible to benefit user from other documents which contain some close terms of the initial query. These documents can exist in other topics classes. Consequently, a reclassification suggested by the system proves its relevance in order to adapt query's results to new user's needs

    Représentations cartographiques intermédiaires : comment covisualiser une carte et une orthophotographie pour naviguer entre abstraction et réalisme ?

    Get PDF
    Two representations of the territory are widely provided simultaneously to the user through interactive tools (such as magnifiers, sliders or swipes): topographic maps and orthoimages. They provide complementary visions of the territory because of abstraction steps used to design maps and the intrisic perceived photorealism power of orthoimages. Aiming at providing efficient covisualizations of these two representations to the user, we advise not to search for an ideal graphic mix, but to produce a cartographic continuum composed of in-between representations mixing topographic data and orthoimagery. Our objective is to provide interactive tools allowing to choose an intermediate step within the continuum by controling the realism and abstraction levels. Our approach is based on three principles: first, the need for local adaptation of vector data symbolisation to preserve their readability, second, the call for graphic transitions to establish a continuity through in-between cartographic representations, and third the required control over realism level in order to ensure a visual consistency of hybrid visualisations. We provide elementary symbolisation methods to be combined in a global design process. The first one aims at interpolating SLD symbolisation parameters such as color, opacity or texturing between two symbolisations. The second one aims at defining a local symbolisation depending on the graphic context of objects to be highlighted. Those symbolisations are combined for each theme and synchronized for all themes. For these design steps, we provide guidelines based on the evaluation of the realism level coming from our user test. Finally we build a prototype software allowing to test our propositions and browse in-between representations from abstraction to realism through an interactive sliderDeux représentations du territoire sont majoritairement proposées pour être covisualisées de multiples façons (loupe, curseurs, vues asservies, etc.) : la carte topographique et l'orthophotographie. Ces deux représentations apportent une vision complémentaire du territoire : la carte topographique est l'archétype même de l'abstraction et l'orthophotographie renvoie une perception réaliste du territoire. Pour permettre à l'utilisateur de covisualiser ces deux types de représentations, nous préconisons de ne pas chercher un mélange graphique idéal mais plutôt de produire un continuum cartographique formé d'un ensemble continu de représentations intermédiaires mixant données topographiques et orthophotographie. Notre objectif est de permettre à l'utilisateur de choisir sa position entre les deux extrémités en contrôlant le degré de réalisme et d'abstraction tout au long du continuum. Notre approche se fonde sur la nécessité d'adaptation locale de la symbolisation des données topographiques pour assurer la lisibilité de chaque représentation intermédiaire, la création de transitions graphiques pour établir une continuité entre ces représentations, et la synchronisation des symbolisations visant à garantir une homogénéité visuelle de ces représentations mixtes. Nous proposons une méthode de conception reposant sur la combinaison de briques de symbolisation élémentaires. Le premier type de brique consiste à interpoler les paramètres de symbolisation de la norme SLD tels que la couleur, la transparence ou la texture (procédurale, naturelle, ou mixée) entre deux symbolisations données. Le second type de brique analyse le contexte graphique des objets à mettre en valeur afin de déterminer localement une symbolisation adaptée et lisible. Ces briques sont combinées pour chaque thème et coordonnées entre les différents thèmes. Nous émettons des préconisations de paramétrage de ces étapes de conception à partir des résultats de notre test utilisateur visant à estimer le degré de réalisme et d'abstraction des symbolisations cartographiques. Enfin, nous mettons en œuvre cette méthode de conception au sein de la plateforme de recherche GeOxygene sous la forme d'un outil permettant de naviguer dans un continuum cartographique entre réalisme et abstractio

    La "parenthèse" badegoulienne : fondements et statut d'une discordance industrielle à travers l'analyse techno-économique de plusieurs ensembles lithiques du Dernier Maximum Glaciaire.

    Get PDF
    The Badegoulian has long been considered as an early stage of the Magdalenian. However, these past decades, a growing amount of discoveries has altered this image and, since the early 1990's, supported by the first technological analyses, the idea of a " cultural " autonomy of the Badegoulian techno-complex has been now commonly accepted. By tacking into account a large sample of assemblages illustrating the whole variability of this peculiar techno-complex, from a geographic area poorly documented (Landes, Lot, Aude), this work aims to answer to two questions: on the one hand, we try to identify and to propose some understanding keys of the Badegoulian techno-economic behavioral variability; on the other hand, its independence reliability has been tested. While the techno-economical bases of the first Badegoulian industries appear to be fundamentally different from the available data for the end of the Solutrean, testifying to a fast shift of its technical traditions, the break with the middle Magdalenian is largely smoothed by the links between the late Badegoulian and the early Magdalenian. Thus, introducing a rupture at the beginning of the LGM, the Badegoulian is part of gradual changes of the technical behaviors applied to lithic equipments, even though a sensible transformation of the technical traditions within the bone industry production occurred during the transition with the Magdalenian.Improbable enfant du Solutréen, le Badegoulien, composé d'industries souvent dépréciées technologiquement, a d'abord été indexé au Magdalénien sous les traits d'une industrie en devenir. Rapidement contesté par l'enchainement des découvertes, ce statut s'est finalement effacé devant leur originalité : à l'aube des années 90 prime ainsi l'idée d'une autonomie " culturelle " que les premières analyses technologiques vont contribuer à affermir. Embrassant une zone géographique jusqu'ici peu investie (Landes, Lot, Aude) et ce, à travers un corpus d'industries constituant un panel représentatif de la variabilité de ces assemblages, notre analyse a poursuivi deux objectifs : tenter, d'une part, de cerner au mieux les comportements techno-économiques badegouliens ainsi que les raisons de cette variabilité et, de l'autre, éprouver la réalité de cette " parenthèse " sur le plan diachronique. Si l'architecture techno-économique des premières industries lithiques badegouliennes nous apparait en définitive très éloignée des données aujourd'hui disponibles sur la fin du Solutréen - attestant d'une recomposition probablement rapide de ces normes techniques -, la rupture souvent évoquée avec le Magdalénien (moyen) se trouve adoucie par les liens existant entre Badegoulien récent et Magdalénien inférieur. Ainsi, introduisant sur le plan des équipements lithiques une coupure assez nette au début du LGM, ce techno-complexe va pourtant s'insérer dans une dynamique marquée par une transformation graduelle des comportements techno-économiques, ceci malgré une modification substantielle des normes techniques régissant le registre osseux entre la fin du Badegoulien et les débuts du Magdalénien

    La production de l’urbain durable. L’enrôlement des concepteurs et des habitants par l’intégration des contradictions

    Get PDF
    The influence of neoliberalism on the production of urban spaces results in the commodification of spaces, the competition between cities, and the metropolisation process. It also generates the spread of watchwords, among which “project”, “sustainable urban development”, “participation” and “social diversity” are the most common.This creates contradictions between the rhetorical and practical aspects of the urban production: the opposition between the theoretically infinite horizon of the urban project on one side, and its realization in timed operations on the other side ; the gap between the values of sustainable urban development, and its achievements dictated by economic imperatives ; the contradiction between the injunction to participate and urban planning as a practice that remains top down ; the gap between advocated social diversity and socially selective urbanization.These contradictions are identified by both designers and inhabitants. However, despite their criticism, the level of conflict in contemporary urban production remains low. Therefore, this work aims to understand and explain which function these contradictions occupy, since they do not lead to an opposition.To achieve this objective, the thesis bases itself on structural constructivism, and the use of representations. Access to the representations of inhabitants and designers is achieved through the collection and analysis of their discourses on two emblematic projects, that are approached as mediation apparatuses of their representations: Bottière-Chénaie in Nantes and Confluence in Lyon.The analysis shows that the contradictions that were identified are integrated into the production mode. Their function is to mobilize: they are part of the enrollment of designers and inhabitants in the contemporary urban production.La production de l’espace urbain vise à la fois l’établissement d’une réalité matérielle, et la transmission de valeurs. Celle-ci s’effectue à travers les réalisations matérielles, et la diffusion de discours théoriques et pratiques sur la ville et l’espace. Chaque époque se caractérise par son mode de spatialisation qui reflète l’idéologie dominante et influence les représentations des acteurs, parmi lesquels ses concepteurs et ses habitants. La production contemporaine de l’urbain est ainsi marquée par le néolibéralisme. Cela se traduit par deux phénomènes, d’une part, la marchandisation des espaces au service des intérêts des villes, en concurrence à l’échelle mondiale, et le processus de métropolisation qui concentre les valeurs dans, et autour, des plus grosses d’entre elles. Cela se traduit, d’autre part, par la diffusion généralisée de certains mots d’ordre. Les plus répandus sont le projet, le développement urbain durable, la participation et la mixité sociale. Ce contexte et ces mots d’ordre introduisent des contradictions entre la rhétorique et la pragmatique de la production de l’urbain. Quatre sont principalement identifiées : l’opposition entre l’horizon théoriquement infini du projet, et sa concrétisation dans des opérations au temps limité et cadré ; le décalage entre les valeurs associées au développement urbain durable, et des réalisations dictées par des impératifs économiques ; la contradiction entre l’injonction à la participation, et une pratique de l’urbanisme demeurant descendante ; l’écart entre une mixité prônée, et une urbanisation socialement sélective.Bien que concepteurs et habitants identifient ces contradictions, et tiennent des discours critiques vis-à-vis de cette production, peu de conflictualité, sinon pas, émerge et en résulte. Partant de l’idée que si elles ne conduisent pas à l’opposition, ou au conflit, ces contradictions occupent une autre fonction, l’objectif de ce travail est de la mettre à jour, de l’interroger et de l’expliquer. Il en découle le jeu d’hypothèses suivant. La première est que cette fonction est d’ordre relationnelle, la deuxième est qu’il est possible de la rendre intelligible par l’étude dialectique, des représentations des deux groupes sociaux, de projets emblématiques, et la troisième est que celles-ci sont accessibles par les discours. À partir de ces hypothèses, et d’un positionnement critique sont développées les approches épistémologique, théorique, et méthodologique de la thèse. Elle s’appuie sur une épistémologie constructivo-structuraliste, et sur l’outil conceptuel que sont les représentations. Ces choix conduisent à modéliser le projet urbain comme un dispositif de médiation des représentations des concepteurs et des habitants. Puis, ils définissent les conditions qui rendent possible le fait à la saisie par les discours. Aussi, la méthode inhérente au travail est double : des visites libres et des entretiens semi directifs ; le couplage d’outils d’analyse de discours, et de contenu.L’examen des propos, recueillis auprès des acteurs des projets d’écoquartiers de Bottière-Chénaie (Nantes), et de Confluence (Lyon), montre que les contradictions mises en évidence sont intégrées au mode de production. Ainsi, elles n’occupent, non pas une fonction oppositionnelle mais mobilisationelle puisqu’elles participent, par différentes logiques, à enrôler concepteurs et habitants, consolidant ainsi la production contemporaine de l’urbain
    corecore