Gallicagram : les archives de presse sous les rotatives de la statistique textuelle

Gallicagram est un nouvel outil de lexicométrie, fondé notamment sur les archives océrisées de la Bibliothèque nationale de France et sur celles du journal Le Monde ; il dénombre dans le corpus choisi et pour une période donnée les occurrences d’un mot ou d’un syntagme, et offre différents modes de...

Ful tanımlama

Kaydedildi:
Detaylı Bibliyografya
Yayımlandı:URI:https://journals.openedition.org/corpus,
Asıl Yazarlar: Courson, Benoît de, Azoulay, Benjamin, Courson, Clara de, Vanni, Laurent, Brunet, Étienne
Materyal Türü: Article ou chapitre numérique
Dil:Français
Baskı/Yayın Bilgisi: Corpus 2023
Konular:
Online Erişim:Accès Université d'Orléans et IFPM
Accès Université d'Orléans et IFPM
Diğer Bilgiler
Özet:Gallicagram est un nouvel outil de lexicométrie, fondé notamment sur les archives océrisées de la Bibliothèque nationale de France et sur celles du journal Le Monde ; il dénombre dans le corpus choisi et pour une période donnée les occurrences d’un mot ou d’un syntagme, et offre différents modes de visualisation des données obtenues. Ce logiciel mérite à plusieurs titres d’être investi par les chercheurs : outre le volume des données qu’il exploite, suffisant pour fonder des analyses lexicométriques depuis le XVIIe siècle jusqu’à nos jours, Gallicagram a sur son concurrent immédiat, Ngram Viewer, l’avantage d’une transparence très supérieure et d’une structure plus constante au cours du temps. L’article présente Gallibase, son extension qui lui applique les outils de la statistique textuelle – en particulier les analyses factorielles et arborées. Il illustre son potentiel et insiste sur l’intérêt spécifique des corpus de presse, qui permettent des études sur périodes courtes.