Discovering Topics in Twitter About the COVID-19 Outbreak in Spain
Use este enlace para citar
http://hdl.handle.net/2183/27683
A non ser que se indique outra cousa, a licenza do ítem descríbese como Atribución-NoComercial-SinDerivadas 4.0 Internacional (CC BY-NC-ND 4.0)
Coleccións
- GI-LYS - Artigos [51]
Metadatos
Mostrar o rexistro completo do ítemTítulo
Discovering Topics in Twitter About the COVID-19 Outbreak in SpainTítulo(s) alternativo(s)
Descubriendo temas en Twitter sobre el brote del COVID-19 en EspañaData
2021Cita bibliográfica
Agüero-Torales, M., Vilares, D., & López-Herrera, A. (2021). Discovering topics in Twitter about the COVID-19 outbreak in Spain. Procesamiento Del Lenguaje Natural, 66, 177-190. Disponible en: http://journal.sepln.org/sepln/ojs/ojs/index.php/pln/article/view/6333/3762
Resumo
[Resumen] En este trabajo, analizamos lo que los usuarios han estado discutiendo en Twitter durante el comienzo de la pandemia causada por el COVID-19. Concretamente, analizamos tres fases diferenciadas de la crisis del COVID-19 en España: el propio tiempo de pre-crisis, el estallido de la enfermedad y el confinamiento. Para llevar esto a cabo, primero recolectamos una gran cantidad de tuits que son preprocesados. A continuación, agrupamos los tuits en distintas temáticas usando un modelo de Latent Dirichlet Allocation, y definimos estrategias generativas y discriminativas para extraer las palabras clave y oraciones más representativas para cada tema. Finalmente, incluimos un exhaustivo análisis cualitativo sobre dichos temas, y cómo estos se corresponden con distintas problemáticas surgidas en España en distintos momentos de la crisis. [Abstract] In this work, we apply topic modeling to study what users have been discussing in Twitter during the beginning of the COVID-19 pandemic. More particularly, we explore the period of time that includes three differentiated phases of the COVID-19 crisis in Spain: the pre-crisis time, the outbreak, and the beginning of the lockdown. To do so, we first collect a large corpus of Spanish tweets and clean them. Then, we cluster the tweets into topics using a Latent Dirichlet Allocation model, and define generative and discriminative routes to later extract the most relevant keywords and sentences for each topic. Finally, we provide an exhaustive qualitative analysis about how such topics correspond to the situation in Spain at different stages of the crisis.
Palabras chave
Natural language processing
Topic modeling
Covid-19
Social media analysis
Twitter
Social networks
Topic modeling
Covid-19
Social media analysis
Social networks
Versión do editor
Dereitos
Atribución-NoComercial-SinDerivadas 4.0 Internacional (CC BY-NC-ND 4.0)
ISSN
1989-7553