Un modèle d’extraction des collocations en langue de spécialité

La grande majorité des applications de traitement automatique des langues qui ont pour domaine les langues de spécialité sont des outils d’extraction terminologique. Elles se concentrent donc naturellement sur l’identification des groupes nominaux et des groupes prépositionnels ou prémodificateurs q...

ver descrição completa

Na minha lista:
Detalhes bibliográficos
Publicado no:URI:https://journals.openedition.org/asp,
Autor principal: Maniez, François
Formato: Article ou chapitre numérique
Idioma:Français
Publicado em: ASp 2010
Assuntos:
Acesso em linha:Accès Université d'Orléans et IFPM
Accès Université d'Orléans et IFPM
Descrição
Resumo:La grande majorité des applications de traitement automatique des langues qui ont pour domaine les langues de spécialité sont des outils d’extraction terminologique. Elles se concentrent donc naturellement sur l’identification des groupes nominaux et des groupes prépositionnels ou prémodificateurs qui leur sont associés. En nous fondant sur un corpus bilingue anglais-français composé d’articles de recherche médicale, nous proposons un modèle d’extraction phraséologique semi-automatisée, dont le point de départ est la recherche des co-occurrents les plus fréquents des formes verbales du texte original (l’anglais), étiqueté morpho-syntaxiquement (POS-tagged). L’indice de probabilité de co-occurrence (z-score) permet dans un premier temps d’établir la liste des collocants les plus fréquents d’un verbe donné dans les classes des adverbes et des noms. On recherche ensuite les adjectifs qui entrent en co-occurrence avec les adverbes et les noms relevés lors de la première étape. Une deuxième méthode utilisant les adverbes comme point de départ de la recherche a été testée et semble donner de meilleurs résultats.