De la segmentation dans les tweets : signes de ponctuation, connecteurs, émoticônes et émojis
Dans cet article, nous appuyant sur un corpus de 3 444 075 tweets correspondant à 44 107 210 tokens (mots, signes de ponctuation, émojis, émoticônes, etc.) recueillis en décembre 2016, nous nous intéressons aux procédés de segmentation à l’œuvre dans les tweets. Après avoir évoqué certaines caractér...
Salvato in:
| Autori principali: | , , |
|---|---|
| Natura: | Artigo |
| Pubblicazione: |
Bases, corpus, langage - UMR 7320
2020
|
| Soggetti: | |
| Accesso online: | https://doi.org/10.4000/corpus.4619 https://hdl.handle.net/20.500.13089/efuv https://journals.openedition.org/corpus/4619 |
| Tags: |
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
