De la segmentation dans les tweets : signes de ponctuation, connecteurs, émoticônes et émojis
Dans cet article, nous appuyant sur un corpus de 3 444 075 tweets correspondant à 44 107 210 tokens (mots, signes de ponctuation, émojis, émoticônes, etc.) recueillis en décembre 2016, nous nous intéressons aux procédés de segmentation à l’œuvre dans les tweets. Après avoir évoqué certaines caractér...
Na minha lista:
| Principais autores: | , , |
|---|---|
| Formato: | Artigo |
| Publicado em: |
Bases, corpus, langage - UMR 7320
2020
|
| Assuntos: | |
| Acesso em linha: | https://doi.org/10.4000/corpus.4619 https://hdl.handle.net/20.500.13089/efuv https://journals.openedition.org/corpus/4619 |
| Tags: |
Sem tags, seja o primeiro a adicionar uma tag!
|
