<?xml version="1.0"?>
<metadata xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:dc="http://purl.org/dc/elements/1.1/"><dc:title>Uvrščanje sovražnega govora v slovenskem in angleškem jeziku</dc:title><dc:creator>PIRNAT,	NIK	(Avtor)
	</dc:creator><dc:creator>Žitnik,	Slavko	(Mentor)
	</dc:creator><dc:subject>večrazredno razvrščanje</dc:subject><dc:subject>procesiranje besedila</dc:subject><dc:subject>sovražni govor</dc:subject><dc:description>S porastom sovražnega govora na družbenih omrežjih je nastala tudi večja potreba po nadzoru, vendar bi bil zaradi velike količine informacij ročni nadzor praktično nemogoč, tako se za določanje sovražnega govora danes po večini uporabljajo nevronske mreže. Za učenje nevronskih mrež potrebujemo veliko število označenih podatkov, vendar so javno dostopne podatkovne množice redko podrobno označene, predvsem to drži za jezike z relativno malo govorci. Za slovenski jezik obstaja malo javno dostopnih podatkovnih množic, ki bi vsebovale več bolj podrobnih oznak, zato preizkusimo kako se izkaže podatkovna množica, ki je sestavljena iz več različnih množic. Na sestavljenih množicah s posplošenimi skupnimi oznakami učimo nevronsko mrežo BERT in naše rezultate primerjamo z rezultati, ki so jih dosegli avtorji prvotnih podatkovnih množic. Ugotovimo, da so rezultati, ki jih dosežemo zadovoljivi in predlagamo izboljšave, ki bi omogočile, da bi na sestavljenih množicah dosegli enako dobre rezultate kot na množicah izdelanih za določeno nalogo.</dc:description><dc:date>2022</dc:date><dc:date>2022-09-15 14:05:00</dc:date><dc:type>Diplomsko delo/naloga</dc:type><dc:identifier>140537</dc:identifier><dc:identifier>VisID: 35097</dc:identifier><dc:identifier>COBISS_ID: 123820291</dc:identifier><dc:language>sl</dc:language></metadata>
