Podrobno

Primerjava sistemov za označevanje jezikovnih popravkov v štirih slovenskih besedilnih korpusih
ID Arhar Holdt, Špela (Avtor), ID Popič, Damjan (Avtor), ID Stritar Kučuk, Mojca (Avtor)

.pdfPDF - Predstavitvena datoteka, prenos (419,13 KB)
MD5: BBDBA626F63C74688E93515AF06E1AAE
URLURL - Izvorni URL, za dostop obiščite https://ebooks.uni-lj.si/ZalozbaUL/catalog/book/664/chapter/3901 Povezava se odpre v novem oknu

Izvleček
Za slovenščino so na voljo oz. v procesu gradnje štirje besedilni korpusi, ki vsebujejo oznake jezikovnih popravkov: Šolar, KOST, Lektor in STIKit. Popravki v teh korpusih so označeni po različnih označevalnih sistemih, prilagojenih specifikam korpusnega gradiva. Prispevek analizira označevalne sisteme, identificira podobnosti in razlike v označevalnih kategorijah in opredeli možnosti za medsebojne preslikave oznak ter primerjalne analize korpusnega gradiva.

Jezik:Slovenski jezik
Ključne besede:slovenščina, besedilni korpusi, jezikovni popravki, KOST, Šolar, Lektor, STIKit
Vrsta gradiva:Članek v reviji
Tipologija:1.16 - Samostojni znanstveni sestavek ali poglavje v monografski publikaciji
Organizacija:FF - Filozofska fakulteta
FRI - Fakulteta za računalništvo in informatiko
Status publikacije:Objavljeno
Različica publikacije:Objavljena publikacija
Leto izida:2024
Št. strani:Str. 11-20
PID:20.500.12556/RUL-179610 Povezava se odpre v novem oknu
UDK:811.163.6:004.9
DOI:10.4312/Obdobja.43.11-20 Povezava se odpre v novem oknu
COBISS.SI-ID:215306243 Povezava se odpre v novem oknu
Datum objave v RUL:18.02.2026
Število ogledov:238
Število prenosov:103
Metapodatki:XML DC-XML DC-RDF
:
Kopiraj citat
Objavi na:Bookmark and Share

Gradivo je del monografije

Naslov:Predpis in norma v jeziku
Uredniki:Saška Štumberger
Kraj izida:Ljubljana
Založnik:Založba Univerze
Leto izida:2024
ISBN:978-961-297-439-8
COBISS.SI-ID:212955907 Povezava se odpre v novem oknu
Naslov zbirke:Zbirka Obdobja
Številčenje v zbirki:43
ISSN zbirke:1408-211X

Sekundarni jezik

Jezik:Angleški jezik
Izvleček:
For Slovenian, four text corpora that contain linguistic error annotations are available or under construction: Šolar, KOST, Lektor, and STIKit. The errors and corrections in these corpora are labeled with different annotation systems, each adapted to the specific characteristics of the corpus material. This article analyses the systems, identifying similarities and differences in the annotation categories, and it explores possibilities for label-mapping and comparative analyses of the corpus material.

Ključne besede:Slovene, text corpora, error annotation, KOST, Šolar, Lektor, STIKit

Projekti

Financer:ARIS - Javna agencija za znanstvenoraziskovalno in inovacijsko dejavnost Republike Slovenije
Številka projekta:J7-3159
Naslov:Empirična podlaga za digitalno podprt razvoj pisne jezikovne zmožnosti

Financer:ARIS - Javna agencija za znanstvenoraziskovalno in inovacijsko dejavnost Republike Slovenije
Številka projekta:P6-0411
Naslov:Jezikovni viri in tehnologije za slovenski jezik

Podobna dela

Podobna dela v RUL:
Podobna dela v drugih slovenskih zbirkah:

Nazaj