Digital repository of Slovenian research organisations

Show document
A+ | A- | Help | SLO | ENG

Title:Primerjalna semantično-pragmatična analiza intenzitetnih označevalcev v avtorskih in umetno generiranih presojevalnih besedilih : raziskovalni podatki za objavo v članku
Authors:ID Košir, Diana, Znanstveno-raziskovalno središče Koper (Author)
Files:.pdf PDF - Presentation file, download (364,57 KB)
MD5: 68C69BF5B1A7502F9882511551A1A136
Description: Predstavitvena datoteka s splošnimi ter metodološkimi informacijami in opisom podatkov
 
.xlsx XLSX - Metadata, download (13,32 KB)
MD5: A6447B1F547D65E38441916A442757EB
Description: Excelov dokument z metapodatki o besedilih, vključenih v analizo.
 
.zip ZIP - Research data, download (477,24 KB)
MD5: 6741BB3A223C58DBF6DB17E99ABDDA08
Description: komprimirana datoteka, ki vsebuje tri mape z različnimi podkorpusi besedil glede na avtorstvo oziroma izvor: »Avtorska besedila«, »Besedila ChatGPT« in »Besedila GaMS« (v vsaki mapi je 12 besedilnih datotek, ki so poimenovane glede na avtorstvo, temo in zaporedno številko ponovitve pri generiranih besedilih, npr. Avtor_Kakovost_življenja_4, ChatGPT_Kakovost_življenja_5, GaMS_Svoboda_govora_1, pri čemer pri UI besedilih zaporedne številke 1–2 pomenijo generiranje besedil s pozivi A, 3–4 uporabo pozivov B s slovenskim družbeno-kulturnim kontekstom, 5–6 pa uporabo pozivov C s humornim slogom)
 
This document has even more files. Complete list of files is available below.
Language:Slovenian
Typology:2.20 - Complete scientific database of research data
Organization:Logo ZRS Koper - Science and Research Centre Koper
Abstract:Podatki so rezultat pilotne primerjalne raziskave avtorskih in s pomočjo UI generiranih presojevalnih besedil, da bi ugotovili, ali se UI besedila, ki so po lastnostih sorodna izbranim avtorskim presojevalnim besedilom (kolumna, blog), razlikujejo z vidika intenzitete jezika, kar se odraža tudi v rabi besednih intenzitetnih označevalcev (po modelu Mikolič 2020). Namen primerjalne korpusne analize (sicer manjšega delovnega korpusa) avtorskih in umetno generiranih besedil z jezikovnima modeloma ChatGPT-5 (brezplačna verzija) in GaMS-12B-Instruct je ugotoviti, ali je slovenski jezikovni model glede na raznolikost in semantično ustreznost rabe intenzitetnih označevalcev (že) bliže slovenskim avtorskim besedilom v primerjavi z globalnim modelom ChatGPT, kar bi lahko bil eden od kazalnikov jezikovne kompetence. Za potrebe raziskave je s pomočjo orodja Sketch Engine nastal manjši delovni korpus »Korpus avtorskih in umetno generiranih presojevalnih besedil«, ki je sestavljen iz treh podkorpusov: (1) 12 avtorskih kolumn oz. blogov, (2) 12 besedil, generiranih z jezikovnim modelom ChatGPT in (3) 12 besedil, generiranih s slovenskim modelom GaMS. S pomočjo orodja Sketch Engine so bili identificirani najpogostejši besedni izrazi, ki se v besedilih nastopajo v vlogi intenzitetnih označevalcev (krepilci, šibilci). V analizi smo se omejili na najpogostejše prislove in členke v tej vlogi med prvimi 50 najpogostejšimi prislovi oz. členki na frekvenčni listi korpusnih lem. Analiza je podala podobne rezultate, kot nekatere študije na anglosaškem gradivu, da obstajajo razlike v rabi intenzitetnih označevalcev med avtorskimi in s ChatGPT-jem generiranimi besedili (pri nas tudi z GaMS-om). Pri avtorskih besedilih se je pokazala večja raznolikost rabljenih izrazov v tej vlogi, zlasti so za avtorska besedila značilni izrazi, ki odražajo subjektivno vrednotenje tvorca, ki pa niso značilni za naša UI generirana besedila. Razlika v pogostosti rabe označevalcev intenzitete se je pokazala tudi pri primerjavi dveh jezikovnih modelov. V stilu besedil ChatGPT izstopa prisotnost izrazov morda, verjetno, lahko in pogosto, ki kažejo na težnjo k previdnemu, zadržanemu in posplošujočemu izražanju (izogibanje premočnim sodbam), kar sicer ni značilnost izbrane vrste presojevalnih besedil (kolumna, blog). Obratno se je pri besedilih modela GaMS pokazala visoka prisotnost izrazov vedno/stalno, najbolj, ki so pomenski presežniki, izrazito malo pa je šibilcev, kar kaže na odločen, okrepljen, a tudi posplošujoč stil (skrajnostno prikazovanje resničnosti).
Keywords:veliki jezikovni modeli, VJM, ChatGPT, GaMS, kolumna in blog, intenziteta jezika, pragmatika in semantika, korpusna analiza
Publication status:Published
Publication version:Version of Record
Place of publishing:Koper
Year of publishing:2026
Year of performance:2026
PID:20.500.12556/DiRROS-31945 New window
Publication date in DiRROS:19.08.2026
Views:49
Downloads:35
Metadata:XML DC-XML DC-RDF
:
Copy citation
  
Share:Bookmark and Share


Hover the mouse pointer over a document title to show the abstract or click on the title to get all document metadata.

Document is financed by a project

Funder:ARIS - Slovenian Research and Innovation Agency
Project number:P5-0409
Name:Razsežnosti slovenstva med lokalnim in globalnim v začetku tretjega tisočletja

Licences

License:CC BY 4.0, Creative Commons Attribution 4.0 International
Link:http://creativecommons.org/licenses/by/4.0/
Description:This is the standard Creative Commons license that gives others maximum freedom to do what they want with the work as long as they credit the author.

Files

Loading...

Back