Traitement automatique des domaines

L’objectif de cet article est de présenter une méthode de traitement automatique de la notion de domaine et des applications qu’induit cette méthode dans la recherche d’informations sur le Web. Après avoir mis l’accent sur les précautions qu’il faut prendre pour attribuer un texte à un domaine donné...

Descripció completa

Guardat en:
Dades bibliogràfiques
Autors principals: Gross, Gaston, Guenthner, Franz
Format: Article ou chapitre numérique
Idioma:Français
Publicat: 1998
Accés en línia:Accès Université d'Orléans et IFPM
Accès Université d'Orléans et IFPM
Descripció
Sumari:L’objectif de cet article est de présenter une méthode de traitement automatique de la notion de domaine et des applications qu’induit cette méthode dans la recherche d’informations sur le Web. Après avoir mis l’accent sur les précautions qu’il faut prendre pour attribuer un texte à un domaine donné, on définit un domaine comme un ensemble d’hyperclasses (humain, concret, locatif, temps, action, etc.), et de classes d’objets, correspondant à la structuration de la phrase simple en prédicats et arguments. Toutes ces informations sémantico-syntaxiques figurent dans des dictionnaires électroniques de langue générale et de langues de spécialité, qui distinguent les mots simples des mots composés. On marquera les pages Web sur la base de ces dictionnaires. Une première application a permis ainsi au moteur de recherches AltaVista d’identifier automatiquement 29 langues. De même, l’identification des mots composés permet de faire des requêtes beaucoup plus précises et rapides que celles que ion ferait en interrogeant sur les éléments lexicaux constitutifs de ces composés. Ces recherches peuvent être encore affinées grâce à la précision supplémentaire qu’apportent les mots composés complexes ? Une application en grandeur réelle a pour objet la langue de la médecine, dans le cadre du projet Webling de la Communauté Européenne.