Un modèle d’extraction des collocations en langue de spécialité
La grande majorité des applications de traitement automatique des langues qui ont pour domaine les langues de spécialité sont des outils d’extraction terminologique. Elles se concentrent donc naturellement sur l’identification des groupes nominaux et des groupes prépositionnels ou prémodificateurs q...
Na minha lista:
| Publicado no: | URI:https://journals.openedition.org/asp, |
|---|---|
| Autor principal: | |
| Formato: | Article ou chapitre numérique |
| Idioma: | Français |
| Publicado em: |
ASp
2010
|
| Assuntos: | |
| Acesso em linha: | Accès Université d'Orléans et IFPM Accès Université d'Orléans et IFPM |
| Resumo: | La grande majorité des applications de traitement automatique des langues qui ont pour domaine les langues de spécialité sont des outils d’extraction terminologique. Elles se concentrent donc naturellement sur l’identification des groupes nominaux et des groupes prépositionnels ou prémodificateurs qui leur sont associés. En nous fondant sur un corpus bilingue anglais-français composé d’articles de recherche médicale, nous proposons un modèle d’extraction phraséologique semi-automatisée, dont le point de départ est la recherche des co-occurrents les plus fréquents des formes verbales du texte original (l’anglais), étiqueté morpho-syntaxiquement (POS-tagged). L’indice de probabilité de co-occurrence (z-score) permet dans un premier temps d’établir la liste des collocants les plus fréquents d’un verbe donné dans les classes des adverbes et des noms. On recherche ensuite les adjectifs qui entrent en co-occurrence avec les adverbes et les noms relevés lors de la première étape. Une deuxième méthode utilisant les adverbes comme point de départ de la recherche a été testée et semble donner de meilleurs résultats. |
|---|