<?xml version="1.0"?>
<metadata xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:dc="http://purl.org/dc/elements/1.1/"><dc:title>Samodejno luščenje definicij iz specializiranih besedil</dc:title><dc:creator>Fišer,	Darja	(Avtor)
	</dc:creator><dc:creator>Pollak,	Senja	(Avtor)
	</dc:creator><dc:creator>Vintar,	Špela	(Avtor)
	</dc:creator><dc:subject>korpusno jezikoslovje</dc:subject><dc:subject>slovenščina</dc:subject><dc:subject>luščenje definicij</dc:subject><dc:subject>luščenje informacij</dc:subject><dc:subject>računalniška obdelava naravnega jezika</dc:subject><dc:subject>strojno učenje</dc:subject><dc:subject>informacijsko poizvedovanje</dc:subject><dc:description>V prispevku predstavljamo novo metodo luščenja definicij iz slovenskih specializiranih besedil, ki temelji na modelu za klasifikacijo definicij, naučenem z uporabo metod strojnega učenja iz primerov v slovenski Wikipediji. Prvi korak metode zajema luščenje kandidatov s pomočjo slovenskega semantičnega leksikona, avtomatskega razpoznavanja terminov ter leksikoskladenjskih vzorcev. V drugem koraku pa z uporabo naučenega klasifikacijskega modela izmed definicijskih kandidatov izberemo "prave" definicije. Iz korpusa s področja naravoslovja smo s to metodo izluščili več kot tisoč definicijskih kandidatov ter z uporabo naučenega modela dosegli do 70-odstotno klasifikacijsko točnost.</dc:description><dc:date>2011</dc:date><dc:date>2023-09-05 11:40:45</dc:date><dc:type>Članek v reviji</dc:type><dc:identifier>149215</dc:identifier><dc:identifier>UDK: 801.8=163.6:81'322.2:004.738.5</dc:identifier><dc:identifier>COBISS_ID: 47262818</dc:identifier><dc:identifier>OceCobissID: 258646784</dc:identifier><dc:language>sl</dc:language></metadata>
