Traitement automatique des domaines
L’objectif de cet article est de présenter une méthode de traitement automatique de la notion de domaine et des applications qu’induit cette méthode dans la recherche d’informations sur le Web. Après avoir mis l’accent sur les précautions qu’il faut prendre pour attribuer un texte à un domaine donné...
Сохранить в:
| Главные авторы: | , |
|---|---|
| Формат: | Article ou chapitre numérique |
| Язык: | Français |
| Опубликовано: |
1998
|
| Online-ссылка: | Accès Université d'Orléans et IFPM Accès Université d'Orléans et IFPM |
| Итог: | L’objectif de cet article est de présenter une méthode de traitement automatique de la notion de domaine et des applications qu’induit cette méthode dans la recherche d’informations sur le Web. Après avoir mis l’accent sur les précautions qu’il faut prendre pour attribuer un texte à un domaine donné, on définit un domaine comme un ensemble d’hyperclasses (humain, concret, locatif, temps, action, etc.), et de classes d’objets, correspondant à la structuration de la phrase simple en prédicats et arguments. Toutes ces informations sémantico-syntaxiques figurent dans des dictionnaires électroniques de langue générale et de langues de spécialité, qui distinguent les mots simples des mots composés. On marquera les pages Web sur la base de ces dictionnaires. Une première application a permis ainsi au moteur de recherches AltaVista d’identifier automatiquement 29 langues. De même, l’identification des mots composés permet de faire des requêtes beaucoup plus précises et rapides que celles que ion ferait en interrogeant sur les éléments lexicaux constitutifs de ces composés. Ces recherches peuvent être encore affinées grâce à la précision supplémentaire qu’apportent les mots composés complexes ? Une application en grandeur réelle a pour objet la langue de la médecine, dans le cadre du projet Webling de la Communauté Européenne. |
|---|