Extraire des données textuelles pour l’analyse du discours : le Détricoteur
Il existe aujourd’hui de nombreux outils en matière d’extraction du contenu textuel sur Internet. Beaucoup de ceux-ci ont été conçus à l’initiative de chercheurs travaillant en traitement automatique du langage, et prennent la forme de « packages » : des modules de codes simples à utiliser pour les...
Gorde:
| Argitaratua izan da: | URI:https://journals.openedition.org/corpus, |
|---|---|
| Egile Nagusiak: | , |
| Formatua: | Article ou chapitre numérique |
| Argitaratua: |
Corpus
2025
|
| Gaiak: | |
| Sarrera elektronikoa: | Accès Université d'Orléans et IFPM Accès Université d'Orléans et IFPM |
| Gaia: | Il existe aujourd’hui de nombreux outils en matière d’extraction du contenu textuel sur Internet. Beaucoup de ceux-ci ont été conçus à l’initiative de chercheurs travaillant en traitement automatique du langage, et prennent la forme de « packages » : des modules de codes simples à utiliser pour les usagers développeurs, mais inaccessibles aux profanes. Les solutions logicielles indépendantes sont peu nombreuses et ne sont pas susceptibles de répondre aux besoins des chercheurs en analyse du discours. Dans cet article, nous présentons le Détricoteur, un programme d’extraction textuelle semi-automatique, qui cherche à répondre aux contraintes épistémologiques de l’analyse du discours tout en étant utilisable même sans connaissances en matière de code informatique. |
|---|