<?xml version="1.0"?>
<rdf:RDF xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:dc="http://purl.org/dc/elements/1.1/"><rdf:Description rdf:about="https://repozitorij.uni-lj.si/IzpisGradiva.php?id=189479"><dc:title>Veliki jezikovni modeli za računalniško oceno osebnostne organizacije iz kliničnih intervjujev z mladostniki</dc:title><dc:creator>Lodrant,	Katarina	(Avtor)
	</dc:creator><dc:creator>Scharnowski,	Frank	(Mentor)
	</dc:creator><dc:creator>Steyrl,	David	(Komentor)
	</dc:creator><dc:subject>veliki jezikovni modeli</dc:subject><dc:subject>VJM_kot_ocenjevalec</dc:subject><dc:subject>osebnostna motnja</dc:subject><dc:subject>osebnostna organizacija</dc:subject><dc:subject>difuzija identitete</dc:subject><dc:description>Pri polstrukturiranih intervjujih v psihiatriji strokovnjaki odgovore pacientov pretvarjajo v številčne ocene na podlagi vnaprej določenih ocenjevalnih kriterijev. Veliki jezikovni modeli (VJM-ji) bi lahko bili primerni za tovrstne naloge, saj lahko obdelujejo obsežna besedila v naravnem jeziku, sledijo podanim navodilom in ustvarjajo strukturirane izhode. Njihova ustreznost za ocenjevanje duševnega zdravja še ni bila zadostno ovrednotena.

V magistrskem delu smo razvili in ovrednotili postopek, ki uporablja VJM za ocenjevanje funkcioniranja identitete, osrednje razsežnosti osebnostne organizacije, iz transkripcij Strukturiranega intervjuja osebnostne organizacije za mladostnike (Structured Interview of Personality Organization—Revised, Adolescent Version; STIPO-R-A). Model GPT-5.1 je prejel odlomke transkripcij in ocenjevalne kriterije instrumenta STIPO-R-A ter bil pozvan, naj generira številčne ocene za 19 postavk domene identiteta. Ujemanje med ocenami VJM-ja in kliničnih strokovnjakov smo preverili na vzorcu 72 nemško govorečih mladostnikov, ki je zajemal celoten spekter patologije, od integrirane do izrazito difuzne identitete. Na podvzorcu 23 primerov smo dodatno preučili ponovljivost ocen modela ter njihovo občutljivost na spremembe predloge poziva in spremembo parametra intenzivnosti sklepanja (ang. reasoning-effort).

VJM je udeležence po resnosti difuzije identitete razvrstil podobno kot klinični ocenjevalci. Skupne ocene VJM-ja in kliničnih strokovnjakov so močno korelirale, vendar je VJM ustvaril ožji razpon ocen ter resne primere ocenjeval nižje kot klinični strokovnjaki. Stopnja ujemanja se je močno razlikovala med posameznimi postavkami. Najvišja je bila pri postavkah, ki temeljijo predvsem na eksplicitni vsebini odgovorov, najnižja pa pri štirih postavkah, ki zahtevajo interpretativno presojo kakovosti udeleženčevih opisov sebe in pomembne druge osebe. Večina neujemanj je predstavljala odstopanje za eno stopnjo na ocenjevalni lestvici. Mere ujemanja so bile konsistentne pri ponovljenih ocenjevanjih, ob različicah predloge poziva in ob povečani intenzivnosti sklepanja. Posamezne ocene so se med temi pogoji nekoliko spreminjale, vendar večinoma le za eno stopnjo lestvice.

To delo predstavlja eno prvih analiz uporabe VJM za ocenjevanje osebnostne organizacije iz kliničnih intervjujev s pacienti. Analiza vzorcev neujemanja med ocenami VJM-ja in kliničnih strokovnjakov je pokazala na konkretne možne izboljšave ocenjevalnega postopka. Te ugotovitve bi lahko koristile tudi kliničnim strokovnjakom, ki razvijajo in uporabljajo kriterije STIPO. Zaradi občutljivosti obravnavanega področja je treba zagotoviti, da se avtomatizirani postopki za ocenjevanje duševnega zdravja uporabljajo le, kadar so podprti z zadostnimi dokazi o veljavnosti in kadar je njihova uporaba upravičena glede na povezana tveganja.</dc:description><dc:publisher>K. Lodrant</dc:publisher><dc:date>2026</dc:date><dc:date>2026-10-07 21:30:09</dc:date><dc:type>Magistrsko delo/naloga</dc:type><dc:identifier>189479</dc:identifier><dc:language>sl</dc:language></rdf:Description></rdf:RDF>
