<?xml version="1.0"?>
<rdf:RDF xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:dc="http://purl.org/dc/elements/1.1/"><rdf:Description rdf:about="https://repozitorij.uni-lj.si/IzpisGradiva.php?id=85513"><dc:title>Statistična analiza slovenskih jezikovnih korpusov</dc:title><dc:creator>KLJUČEVŠEK,	ALEKSANDER	(Avtor)
	</dc:creator><dc:creator>Robnik Šikonja,	Marko	(Mentor)
	</dc:creator><dc:creator>Krek,	Simon	(Komentor)
	</dc:creator><dc:subject>statistična analiza jezika</dc:subject><dc:subject>jezikovni korpus</dc:subject><dc:subject>Gigafida</dc:subject><dc:subject>paralelni algoritmi</dc:subject><dc:description>Področje procesiranja naravnega jezika je pomembna in obsežna panoga računalništva, vendar je večina obstoječih orodij razvitih in prilagojenih za obdelavo angleških besedil. Razvili smo orodje za statistično analizo velikih jezikovnih korpusov, ki upošteva značilnosti slovenščine kot močno pregibnega jezika. Današnji besedilni korpusi lahko vsebujejo tudi več milijard besed, zato je bil velik del pozornosti namenjen razvoju učinkovitih paralelnih algoritmov, s katerimi bo moč tako obsežne zbirke v razmeroma kratkem času obdelati tudi na običajnih računalnikih. Z orodjem smo analizirali korpus Gigafida, ki vsebuje 1,2 milijarde besed, na več nivojih: na nivoju besednih nizov, nivoju besed, n-gramov, predpon in končnic ter tudi besedotvorne procese v slovenščini.</dc:description><dc:date>2016</dc:date><dc:date>2016-09-15 17:25:04</dc:date><dc:type>Diplomsko delo</dc:type><dc:identifier>85513</dc:identifier><dc:language>sl</dc:language></rdf:Description></rdf:RDF>
