<?xml version="1.0"?>
<metadata xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:dc="http://purl.org/dc/elements/1.1/"><dc:title>Avtomatska ekstrakcija podatkov o zaposlenih s spletišč podjetij</dc:title><dc:creator>Koplan,	Matej	(Avtor)
	</dc:creator><dc:creator>Žitnik,	Slavko	(Mentor)
	</dc:creator><dc:subject>splet</dc:subject><dc:subject>ekstrakcija podatkov</dc:subject><dc:subject>avtomatska ekstrakcija podatkov s spleta</dc:subject><dc:subject>fokusirani spletni pajki</dc:subject><dc:subject>strukturirani podatki</dc:subject><dc:subject>nestrukturirani podatki</dc:subject><dc:description>V tem delu se ukvarjamo s problemom ekstrakcije seznama oseb s poljubnega spletišča. V ta namen implementiramo spletnega pajka za identifikacijo potencialnih podstrani z osebami in ekstraktor podatkov, ki s poljubne spletne strani izvleče podatke o osebah. 
Pokažemo, da osnovne metode, kot so primerjava imena s seznamom imen, ne dosežejo sprejemljive natančnosti. Pokažemo, da je analiza strukture seznama in prenos odkritega znanja ključna metoda za izboljšavo rezultatov do stopnje, kjer dosežemo sprejemljiv nivo natančnosti. S pomočjo tega pristopa smo izboljšali F1 mero za 50 % na razvojni in za 35 % na skriti testni množici.</dc:description><dc:date>2021</dc:date><dc:date>2021-10-25 07:55:00</dc:date><dc:type>Magistrsko delo/naloga</dc:type><dc:identifier>132403</dc:identifier><dc:identifier>VisID: 28541</dc:identifier><dc:identifier>COBISS_ID: 83603971</dc:identifier><dc:language>sl</dc:language></metadata>
