Identification automatique du lexique scientifique transdisciplinaire
RésuméLe désir d’appuyer le travail des sciences du langage sur de larges collections de données orales (« grands corpus ») est, de nos jours, largement partagé par les linguistes. Au moment où de tels outils se multiplient pour le français, il importe d’être sensible à tous les facteurs qui en gara...
Salvato in:
| Autore principale: | |
|---|---|
| Natura: | Article ou chapitre numérique |
| Lingua: | Français |
| Pubblicazione: |
2007
|
| Accesso online: | Accès Université d'Orléans et IFPM Accès Université d'Orléans et IFPM |
| Riassunto: | RésuméLe désir d’appuyer le travail des sciences du langage sur de larges collections de données orales (« grands corpus ») est, de nos jours, largement partagé par les linguistes. Au moment où de tels outils se multiplient pour le français, il importe d’être sensible à tous les facteurs qui en garantissent la fiabilité, lors des différentes étapes de l’obtention des données : mise au point sur le terme de « corpus », réflexion sur le rapport au terrain et à l’oralité, sur la notion de représentativité (genres et/ou identités des locuteurs), pratiques de sollicitation de données, et enfin transcription. |
|---|