De l’évaluation et ses ressources en traitement automatique des langues

Le traitement informatique du langage a privilégié depuis trente ans les méthodes d’apprentissage automatique qui ont permis des avancées technologiques opérationnelles dans un nombre croissant d’applications. Celles-ci ont été rendues possibles par la disponibilité de corpus d’apprentissage, par le...

Fuld beskrivelse

Enregistré dans:
Bibliografiske detaljer
Auteurs principaux: Paroubek, Patrick, Mariani, Joseph
Format: Article ou chapitre numérique
Sprog:Français
Udgivet: 2019
Fag:
Online adgang:Accès Université d'Orléans et IFPM
Accès Université d'Orléans et IFPM
Beskrivelse
Summary:Le traitement informatique du langage a privilégié depuis trente ans les méthodes d’apprentissage automatique qui ont permis des avancées technologiques opérationnelles dans un nombre croissant d’applications. Celles-ci ont été rendues possibles par la disponibilité de corpus d’apprentissage, par le développement du paradigme d’évaluation (shared tasks) et par la création d’infrastructures d’évaluation de technologie. Mais les corpus doivent être de taille suffisante pour représenter la réalité linguistique et toutes les langues ne disposent pas des ressources appropriées ni des moyens pour les produire. Les expériences ont montré que la taille des données d’apprentissage peut remplacer la complexité algorithmique ou les connaissances expertes, mais a-t-on atteint les limites de ce type d’approche ?