izpis_h1_title_alt

Učenje odgovarjanja na vprašanja v slovenskem jeziku
ID Logar, Katja (Avtor), ID Robnik Šikonja, Marko (Mentor) Več o mentorju... Povezava se odpre v novem oknu

.pdfPDF - Predstavitvena datoteka, prenos (528,59 KB)
MD5: 84B397C9E0AB78BF2030EF24D608D0F4

Izvleček
Odgovarjanje na vprašanja je pomembna in pogosto naslovljena naloga obdelave naravnega jezika v angleščini. Jezikom z manj viri, kakršna je slovenščina, je namenjeno manj pozornosti. V tem delu uporabimo enega izmed uspešnih angleških pristopov, poimenovanega UnifiedQA, in preizkusimo njegovo delovanje za slovenski jezik. Naučimo generativni model za odgovarjanje na vprašanja, ki pokriva štiri različne tipe vprašanj - da/ne, večizbirni, abstraktni in ekstraktivni tip. Za učenje uporabimo obstoječe podatkovne zbirke BoolQ, COPA, MultiRC in SQuAD 2.0 ter strojno prevedemo podatkovno zbirko MCTest. Pokažemo, da je splošni model sposoben odgovarjati na vprašanja v različnih formatih, saj deluje vsaj tako dobro kot namenski modeli, z vnosom angleškega znanja pa rezultate še izboljšamo.

Jezik:Slovenski jezik
Ključne besede:generativno odgovarjanje na vprašanja, slovenski jezik, globoke nevronske mreže, arhitektura transformer
Vrsta gradiva:Magistrsko delo/naloga
Tipologija:2.09 - Magistrsko delo
Organizacija:FRI - Fakulteta za računalništvo in informatiko
Leto izida:2022
PID:20.500.12556/RUL-140005 Povezava se odpre v novem oknu
COBISS.SI-ID:122046723 Povezava se odpre v novem oknu
Datum objave v RUL:09.09.2022
Število ogledov:1040
Število prenosov:164
Metapodatki:XML RDF-CHPDL DC-XML DC-RDF
:
Kopiraj citat
Objavi na:Bookmark and Share

Sekundarni jezik

Jezik:Angleški jezik
Naslov:Learning question answering in Slovene language
Izvleček:
There have been many studies in the field of question answering for English language. Less attention has been devoted to low-resource languages, such as Slovene. In this work, we use one of successful English approaches, named UnifiedQA, and test its viability for Slovene language. We finetune a generative model for question answering, covering four different question formats - yes/no, multiple choice, abstractive and extractive format. For finetuning, we use existing datasets BoolQ, COPA, MultiRC and SQuAD 2.0 and machine translate the MCTest dataset. We show that a general model is capable of answering questions in different formats at least as well as specialized models. The results are further improved using examples in English language.

Ključne besede:generative question answering, Slovene language, deep neural networks, transformer architecture

Podobna dela

Podobna dela v RUL:
Podobna dela v drugih slovenskih zbirkah:

Nazaj