<?xml version="1.0" encoding="utf-8"?>
<Gradivo ID="164985" NadgradivoID="0" NRID="25402102" OceID="0" DomainUrl="https://repozitorij.uni-lj.si/" IzpisPolniUrl="https://repozitorij.uni-lj.si/IzpisGradiva.php?lang=slv&amp;id=164985" StOgledov="593" StPrenosov="140" StOcen="0" VsotaOcen="0" DatumIzvoza="2026-09-15 21:34:38" OcenaSkupna="0" StPodgradiv="0" StudijskiProgramEvsID="1000468" JeIndeksirano="0" JeVecAvtorjev="0" DovoliZahtevkeZaDostop="0">
  <PID Url="http://hdl.handle.net/20.500.12556/RUL-164985">20.500.12556/RUL-164985</PID>
  <Naslov>Uporaba razlag v velikih jezikovnih modelih za prepoznavanje sarkazma v slovenščini</Naslov>
  <Podnaslov></Podnaslov>
  <TujJezik_Naslov>Using explanations and large language models for sarcasm detection in Slovene</TujJezik_Naslov>
  <TujJezik_Podnaslov></TujJezik_Podnaslov>
  <Opis>Strojna obdelava naravnega jezika je v zadnjih letih zelo napredovala. Pomemben del je tudi zaznavanje sarkazma, ki nam omogoča boljše razumevanje sentimenta besedil. Problem strojnega zaznavanja sarkazma v slovenščini je malo raziskan.
V tej nalogi raziščemo zaznavanje sarkazma v slovenščini s pomočjo enojezičnih slovenskih (SloBERTa) in večjezičnih (Llama3 8B in GPT-4o) velikih jezikovnih modelov. Uporabili smo množici Reddit komentarjev in naslovov člankov v angleščini, ki smo ju najprej strojno prevedli v slovenščino. Uporabili smo prilagajanje modelov in gradnjo ukaznih pozivov in preverili njihovo uspešnost zaznave sarkazma. Uspešnost modelov smo poskusili izboljšati z dodajanjem razlag primerom.
Najboljše rezultate smo dosegli s prilagajanjem modelov z modelom Llama3 8B, sledil pa mu je model SloBERTa. Rezultati modela GPT-4o z gradnjo ukaznega poziva so bili nekoliko slabši. Z dodajanjem razlag smo jih opazno izboljšali, vendar pa niso presegli prilagojenih modelov. Rezultati modela Llama3 8B z gradnjo ukaznega poziva so bili komaj kaj boljši od naključnega ugibanja, z dodajanjem razlag pa smo dosegli minimalne izboljšave.</Opis>
  <TujJezik_Opis>Natural language processing (NLP) has advanced significantly in recent years. An important part of NLP is sarcasm detection which enables better understanding of sentiment in texts. There is little research on sarcasm detection in Slovene.
In this thesis we explore sarcasm detection in Slovene using monolingual Slovene (SloBERTa) and multilingual (Llama3 8B and GPT-4o) large language models. We used two datasets in English, namely the Reddit comment and news headlines datasets, which we first translated using machine translation. We used fine-tuning and prompt engineering and evaluated their success rate. We also tried to improve the models&#039; success rate by adding explanations to our examples.
The best results were achieved through fine-tuning with Llama3 8B, followed by SloBERTa. Results from prompt engineering with GPT-4o were slightly worse. While adding explanations led to a significant improvement of GPT-4o, the results did not surpass those obtained by fine-tuning the significantly smaller SloBERTa model and Llama3 8B model. The results with Llama3 8B using prompt engineering were only slightly better than random guessing and adding explanations provided minimal improvements.</TujJezik_Opis>
  <KljucneBesede>
    <Beseda>obdelava naravnega jezika</Beseda>
    <Beseda>jezikovni modeli</Beseda>
    <Beseda>prepoznavanje sarkazma</Beseda>
  </KljucneBesede>
  <TujJezik_KljucneBesede>
    <Beseda>natural language processing</Beseda>
    <Beseda>language models</Beseda>
    <Beseda>sarcasm detection</Beseda>
  </TujJezik_KljucneBesede>
  <Potrjeno>true</Potrjeno>
  <JeZaklenjeno>false</JeZaklenjeno>
  <JeRecenzirano>false</JeRecenzirano>
  <Zaloznik></Zaloznik>
  <Izvor></Izvor>
  <Jezik ID="1060" ISO639-3="slv">Slovenski jezik</Jezik>
  <TujJezik ID="1033" ISO639-3="eng">Angleški jezik</TujJezik>
  <Povezave></Povezave>
  <Pokrivanje></Pokrivanje>
  <CasovnoPokritje></CasovnoPokritje>
  <AvtorskePravice></AvtorskePravice>
  <VrstaGradiva ID="mb11" DRIVER="info:eu-repo/semantics/bachelorThesis">Diplomsko delo/naloga</VrstaGradiva>
  <DatumVstavljanja>2024-11-19 16:15:02</DatumVstavljanja>
  <DatumObjave>2024-11-19 16:15:11</DatumObjave>
  <DatumSpremembe>2024-12-06 09:51:11</DatumSpremembe>
  <DatumTrajnegaHranjenja>0000-00-00 00:00:00</DatumTrajnegaHranjenja>
  <LetoIzida>2024</LetoIzida>
  <LetoIzidaDo>0</LetoIzidaDo>
  <KrajIzida></KrajIzida>
  <LetoIzvedbe>0</LetoIzvedbe>
  <KrajIzvedbe></KrajIzvedbe>
  <Opomba></Opomba>
  <StStrani></StStrani>
  <StevilcenjeNivo1></StevilcenjeNivo1>
  <StevilcenjeNivo2></StevilcenjeNivo2>
  <Kronologija></Kronologija>
  <Patent_Stevilka></Patent_Stevilka>
  <Patent_DatumVeljavnosti>0000-00-00</Patent_DatumVeljavnosti>
  <VerzijaDokumenta>NiDoloceno</VerzijaDokumenta>
  <StatusObjaveDrugje>NiDoloceno</StatusObjaveDrugje>
  <VrstaStroskaObjave>NiDoloceno</VrstaStroskaObjave>
  <DatumPoslanoVRecenzijo>0000-00-00</DatumPoslanoVRecenzijo>
  <DatumSprejetjaClanka>0000-00-00</DatumSprejetjaClanka>
  <DatumObjaveClanka>0000-00-00</DatumObjaveClanka>
  <EmbargoDo></EmbargoDo>
  <VrstaEmbarga ID="1" Naziv="Takojšnja javna objava" OpenAIREDostop="openAccess"></VrstaEmbarga>
  <Osebe>
    <Oseba ID="88293" Ime="Gašper" Priimek="Jug" AltIme="" VlogaID="70" VlogaNaziv="Avtor" ConorID="" Afiliacija="" ArrsID="0" ORCID=""></Oseba>
    <Oseba ID="2857" Ime="Marko" Priimek="Robnik Šikonja" AltIme="Marko Robnik Šikonja; Marko Robnik- Šikonja; Marko Robnik-Šikonja; Marko Robnik; Marko Robnik-Sikonja; Marko Robnik- Sikonja" VlogaID="991" VlogaNaziv="Mentor" ConorID="4190307" Afiliacija="" ArrsID="15295" ORCID=""></Oseba>
  </Osebe>
  <Identifikatorji>
    <Identifikator ID="16" Sifra="VisID" Naziv="VisID" URL="">37848</Identifikator>
    <Identifikator ID="3" Sifra="CobissID" Naziv="COBISS_ID" URL="https://plus.cobiss.net/cobiss/si/sl/bib/217952259">217952259</Identifikator>
  </Identifikatorji>
  <Datoteke>
    <Datoteka ID="195882" DatotekaNRID="13993561" NamenDatotekeID="2" NamenDatoteke="Predstavitvena datoteka" FormatDatotekeID="2" FormatDatoteke=".pdf" MIME="application/pdf" IkonaFormata="pdf.png" IkonaFormataPolniUrl="https://repozitorij.uni-lj.si/teme/rulDev/img/fileTypes/pdf.png" VelikostDatoteke="390728" VelikostDatotekeKratko="381,57 KB" DatumVstavljanja="2024-11-19 16:15:12" JeZbrisana="false" JeJavnoVidna="true" JeIndeksirana="true" JeVidno="true" VidnoOd="01.01.1970" Zaporedje="0">
      <Naziv>Jug_Gasper_-_Uporaba_razlag_v_velikih_jezikovnih_modelih_za_prepoznavanje_sarkazma_v_slovenscini.pdf</Naziv>
      <OrgNaziv>Jug_Gasper_-_Uporaba_razlag_v_velikih_jezikovnih_modelih_za_prepoznavanje_sarkazma_v_slovenscini.pdf</OrgNaziv>
      <URL></URL>
      <Opis></Opis>
      <OpisTujJezik></OpisTujJezik>
      <UrlObdelave></UrlObdelave>
      <FrekvencaAzuriranjaID>1</FrekvencaAzuriranjaID>
      <Verzija></Verzija>
      <MD5>F807CFB3B0C4E6816756D40CB68F4F59</MD5>
      <SHA256>b606f47ff3d988e09079f34591bf017ab168b5a06a218c830b788c11226babab</SHA256>
      <UUID>aee44986-a688-11ef-b232-0050569b8976</UUID>
      <PID></PID>
      <PrenosPolniUrl>https://repozitorij.uni-lj.si/Dokument.php?lang=slv&amp;id=195882</PrenosPolniUrl>
      <Vsebine>
        <Vsebina TipVsebine="GoloBesedilo" JezikID="1060" Oznaka="" Dolzina="53926"></Vsebina>
      </Vsebine>
    </Datoteka>
  </Datoteke>
  <Organizacije>
    <Organizacija OrganizacijaID="25" Kratica="FRI" ZavodEvsID="0000066" Logo="" LogoPolniUrl="https://repozitorij.uni-lj.si/teme/rulDev/img/logo/">Fakulteta za računalništvo in informatiko</Organizacija>
  </Organizacije>
  <OrganizacijeVira>
  </OrganizacijeVira>
  <MetodeZbiranjaPodatkov>
  </MetodeZbiranjaPodatkov>
  <TipologijaDela ID="2.11" Koda="2.11" Naziv="Diplomsko delo" SchemaOrg="Thesis"></TipologijaDela>
  <Ostalo>
    <StIrodsDatotek>0</StIrodsDatotek>
    <StDatotekPodTrajnimEmbargom>0</StDatotekPodTrajnimEmbargom>
    <StDatotekZOmejenimDostopom>0</StDatotekZOmejenimDostopom>
  </Ostalo>
</Gradivo>
