De la segmentation dans les tweets : signes de ponctuation, connecteurs, émoticônes et émojis
Dans cet article, nous appuyant sur un corpus de 3 444 075 tweets correspondant à 44 107 210 tokens (mots, signes de ponctuation, émojis, émoticônes, etc.) recueillis en décembre 2016, nous nous intéressons aux procédés de segmentation à l’œuvre dans les tweets. Après avoir évoqué certaines caractér...
Tallennettuna:
| Julkaisussa: | URI:https://journals.openedition.org/corpus, |
|---|---|
| Päätekijät: | , , |
| Aineistotyyppi: | Article ou chapitre numérique |
| Julkaistu: |
Corpus
2020
|
| Aiheet: | |
| Linkit: | Accès Université d'Orléans et IFPM Accès Université d'Orléans et IFPM |