Ta magistrska naloga preučuje učinkovitost velikih jezikovnih modelov (LLM) za prepoznavanje stališč v nemško govorečih skupnostih na Redditu in raziskuje njihovo uporabo pri spletnem raziskovanju javnega mnenja. Magistrska naloga ocenjuje različne LLM-je in tehnike načrtovanja pozivov na ročno označenem naboru podatkov iz subreddita r/de.
Eksperimentalni rezultati kažejo, da lahko komercialni LLM-ji, kot je Claude 3.5 Sonnet, izvajajo prepoznavanje stališč v nemških komentarjih na Redditu z visoko natančnostjo (ocene F1 >0,8) brez finega uglaševanja. Tudi odprtokodni modeli kažejo obetavne rezultate. Načrtovanje pozivov z majhnim številom učnih primerov in verižnim sklepanjem je dosledno presegalo pristope brez primerov, medtem ko dodaten kontekst zmanjšuje učinkovitost pri vseh modelih.
Magistrska naloga nato prototipsko uporabi razvito metodologijo za analizo trendov javnega mnenja glede nemške vojaške pomoči Ukrajini. Opaziti je nekaj povezanosti med sentimentom na Redditu in širšimi anketami javnega mnenja, kar nakazuje potencial za uporabo prepoznavanja stališč na podlagi LLM-jev na družbenih omrežjih kot dopolnilno orodje tradicionalnim anketnim metodam.
Omejitve vključujejo osredotočenost na en sam subreddit in eno samo temo ter zanašanje na majhen ročno označen nabor podatkov. Prihodnje raziskovalne smeri vključujejo širitev na več skupnosti in jezikov, preučevanje tehnik finega uglaševanja, izvajanje longitudinalnih študij in izboljšanje razložljivosti.
|