Digitalni repozitorij raziskovalnih organizacij Slovenije

Izpis gradiva
A+ | A- | Pomoč | SLO | ENG

Naslov:Primerjalna semantično-pragmatična analiza intenzitetnih označevalcev v avtorskih in umetno generiranih presojevalnih besedilih : raziskovalni podatki za objavo v članku
Avtorji:ID Košir, Diana, Znanstveno-raziskovalno središče Koper (Avtor)
Datoteke:.pdf PDF - Predstavitvena datoteka, prenos (364,57 KB)
MD5: 68C69BF5B1A7502F9882511551A1A136
Opis: Predstavitvena datoteka s splošnimi ter metodološkimi informacijami in opisom podatkov
 
.xlsx XLSX - Metapodatki, prenos (13,32 KB)
MD5: A6447B1F547D65E38441916A442757EB
Opis: Excelov dokument z metapodatki o besedilih, vključenih v analizo.
 
.zip ZIP - Raziskovalni podatki, prenos (477,24 KB)
MD5: 6741BB3A223C58DBF6DB17E99ABDDA08
Opis: komprimirana datoteka, ki vsebuje tri mape z različnimi podkorpusi besedil glede na avtorstvo oziroma izvor: »Avtorska besedila«, »Besedila ChatGPT« in »Besedila GaMS« (v vsaki mapi je 12 besedilnih datotek, ki so poimenovane glede na avtorstvo, temo in zaporedno številko ponovitve pri generiranih besedilih, npr. Avtor_Kakovost_življenja_4, ChatGPT_Kakovost_življenja_5, GaMS_Svoboda_govora_1, pri čemer pri UI besedilih zaporedne številke 1–2 pomenijo generiranje besedil s pozivi A, 3–4 uporabo pozivov B s slovenskim družbeno-kulturnim kontekstom, 5–6 pa uporabo pozivov C s humornim slogom)
 
To gradivo ima še več datotek. Celoten seznam je na voljo spodaj.
Jezik:Slovenski jezik
Tipologija:2.20 - Zaključena znanstvena zbirka raziskovalnih podatkov
Organizacija:Logo ZRS Koper - Znanstveno-raziskovalno središče Koper / Centro di Ricerche Scientifiche Capodistria
Povzetek:Podatki so rezultat pilotne primerjalne raziskave avtorskih in s pomočjo UI generiranih presojevalnih besedil, da bi ugotovili, ali se UI besedila, ki so po lastnostih sorodna izbranim avtorskim presojevalnim besedilom (kolumna, blog), razlikujejo z vidika intenzitete jezika, kar se odraža tudi v rabi besednih intenzitetnih označevalcev (po modelu Mikolič 2020). Namen primerjalne korpusne analize (sicer manjšega delovnega korpusa) avtorskih in umetno generiranih besedil z jezikovnima modeloma ChatGPT-5 (brezplačna verzija) in GaMS-12B-Instruct je ugotoviti, ali je slovenski jezikovni model glede na raznolikost in semantično ustreznost rabe intenzitetnih označevalcev (že) bliže slovenskim avtorskim besedilom v primerjavi z globalnim modelom ChatGPT, kar bi lahko bil eden od kazalnikov jezikovne kompetence. Za potrebe raziskave je s pomočjo orodja Sketch Engine nastal manjši delovni korpus »Korpus avtorskih in umetno generiranih presojevalnih besedil«, ki je sestavljen iz treh podkorpusov: (1) 12 avtorskih kolumn oz. blogov, (2) 12 besedil, generiranih z jezikovnim modelom ChatGPT in (3) 12 besedil, generiranih s slovenskim modelom GaMS. S pomočjo orodja Sketch Engine so bili identificirani najpogostejši besedni izrazi, ki se v besedilih nastopajo v vlogi intenzitetnih označevalcev (krepilci, šibilci). V analizi smo se omejili na najpogostejše prislove in členke v tej vlogi med prvimi 50 najpogostejšimi prislovi oz. členki na frekvenčni listi korpusnih lem. Analiza je podala podobne rezultate, kot nekatere študije na anglosaškem gradivu, da obstajajo razlike v rabi intenzitetnih označevalcev med avtorskimi in s ChatGPT-jem generiranimi besedili (pri nas tudi z GaMS-om). Pri avtorskih besedilih se je pokazala večja raznolikost rabljenih izrazov v tej vlogi, zlasti so za avtorska besedila značilni izrazi, ki odražajo subjektivno vrednotenje tvorca, ki pa niso značilni za naša UI generirana besedila. Razlika v pogostosti rabe označevalcev intenzitete se je pokazala tudi pri primerjavi dveh jezikovnih modelov. V stilu besedil ChatGPT izstopa prisotnost izrazov morda, verjetno, lahko in pogosto, ki kažejo na težnjo k previdnemu, zadržanemu in posplošujočemu izražanju (izogibanje premočnim sodbam), kar sicer ni značilnost izbrane vrste presojevalnih besedil (kolumna, blog). Obratno se je pri besedilih modela GaMS pokazala visoka prisotnost izrazov vedno/stalno, najbolj, ki so pomenski presežniki, izrazito malo pa je šibilcev, kar kaže na odločen, okrepljen, a tudi posplošujoč stil (skrajnostno prikazovanje resničnosti).
Ključne besede:veliki jezikovni modeli, VJM, ChatGPT, GaMS, kolumna in blog, intenziteta jezika, pragmatika in semantika, korpusna analiza
Status publikacije:Objavljeno
Verzija publikacije:Objavljena publikacija
Kraj izida:Koper
Leto izida:2026
Leto izvedbe:2026
PID:20.500.12556/DiRROS-31945 Novo okno
Datum objave v DiRROS:19.08.2026
Število ogledov:46
Število prenosov:34
Metapodatki:XML DC-XML DC-RDF
:
Kopiraj citat
  
Objavi na:Bookmark and Share


Postavite miškin kazalec na naslov za izpis povzetka. Klik na naslov izpiše podrobnosti ali sproži prenos.

Gradivo je financirano iz projekta

Financer:ARIS - Javna agencija za znanstvenoraziskovalno in inovacijsko dejavnost Republike Slovenije
Številka projekta:P5-0409
Naslov:Razsežnosti slovenstva med lokalnim in globalnim v začetku tretjega tisočletja

Licence

Licenca:CC BY 4.0, Creative Commons Priznanje avtorstva 4.0 Mednarodna
Povezava:http://creativecommons.org/licenses/by/4.0/deed.sl
Opis:To je standardna licenca Creative Commons, ki daje uporabnikom največ možnosti za nadaljnjo uporabo dela, pri čemer morajo navesti avtorja.

Datoteke

Podatki se nalagajo...

Nazaj