Analiza tematik in sentimenta slovenskih medijev z orodji za obdelavo naravnega jezika

Autor: BAJT, JAN
Přispěvatelé: Robnik Šikonja, Marko
Jazyk: slovinština
Rok vydání: 2021
Předmět:
Popis: V diplomskem delu primerjamo slovenske medije s pomočjo analize tematik in sentimenta člankov. Želeli smo analizirati različna stališča medijev do specifičnih političnih dogodkov oziroma tematik. Tematike smo modelirali z modelom LDA, s katerim smo v množici slovenskih člankov poiskali tiste s politično vsebino. Za nalogo zaznavanja sentimenta smo prilagodili model SloBERTa in ga uporabili pri klasifikaciji izbranih člankov v eno izmed treh oznak (pozitivno, nevtralno, negativno). Primerjavo medijev izvedemo na nekaj različnih političnih temah, kjer opazimo nekaj razlik med skupinami medijev. Rezultate predstavimo in izpostavimo nekaj slabosti našega sistema ter podamo predloge za izboljšavo. We compare topics covered by Slovenian media by analysing sentiment of the articles. We aim to analyse different stances of media towards specific political events or topics. We used LDA model for topic modeling and based on results, we selected articles with political content. For the sentiment analysis task we fine-tuned Slovenian SloBERTa model which we used to classify articles in one of three sentiment labels (positive, neutral, negative). We compare the media on a few political topics, where we notice differences between media. We present the results, highlight weaknesses of our system and suggest improvements.
Databáze: OpenAIRE