Identification automatique du lexique scientifique transdisciplinaire

RésuméLe désir d’appuyer le travail des sciences du langage sur de larges collections de données orales (« grands corpus ») est, de nos jours, largement partagé par les linguistes. Au moment où de tels outils se multiplient pour le français, il importe d’être sensible à tous les facteurs qui en gara...

Descrizione completa

Salvato in:
Dettagli Bibliografici
Autore principale: Drouin, Patrick
Natura: Article ou chapitre numérique
Lingua:Français
Pubblicazione: 2007
Accesso online:Accès Université d'Orléans et IFPM
Accès Université d'Orléans et IFPM
Descrizione
Riassunto:RésuméLe désir d’appuyer le travail des sciences du langage sur de larges collections de données orales (« grands corpus ») est, de nos jours, largement partagé par les linguistes. Au moment où de tels outils se multiplient pour le français, il importe d’être sensible à tous les facteurs qui en garantissent la fiabilité, lors des différentes étapes de l’obtention des données : mise au point sur le terme de « corpus », réflexion sur le rapport au terrain et à l’oralité, sur la notion de représentativité (genres et/ou identités des locuteurs), pratiques de sollicitation de données, et enfin transcription.