| Naslov: | Primerjalna semantično-pragmatična analiza intenzitetnih označevalcev v avtorskih in umetno generiranih presojevalnih besedilih : raziskovalni podatki za objavo v članku |
|---|
| Avtorji: | ID Košir, Diana, Znanstveno-raziskovalno središče Koper (Avtor) |
| Datoteke: | PDF - Predstavitvena datoteka, prenos (364,57 KB) MD5: 68C69BF5B1A7502F9882511551A1A136 Opis: Predstavitvena datoteka s splošnimi ter metodološkimi informacijami in opisom podatkov
XLSX - Metapodatki, prenos (13,32 KB) MD5: A6447B1F547D65E38441916A442757EB Opis: Excelov dokument z metapodatki o besedilih, vključenih v analizo.
ZIP - Raziskovalni podatki, prenos (477,24 KB) MD5: 6741BB3A223C58DBF6DB17E99ABDDA08 Opis: komprimirana datoteka, ki vsebuje tri mape z različnimi podkorpusi besedil glede na avtorstvo oziroma izvor: »Avtorska besedila«, »Besedila ChatGPT« in »Besedila GaMS« (v vsaki mapi je 12 besedilnih datotek, ki so poimenovane glede na avtorstvo, temo in zaporedno številko ponovitve pri generiranih besedilih, npr. Avtor_Kakovost_življenja_4, ChatGPT_Kakovost_življenja_5, GaMS_Svoboda_govora_1, pri čemer pri UI besedilih zaporedne številke 1–2 pomenijo generiranje besedil s pozivi A, 3–4 uporabo pozivov B s slovenskim družbeno-kulturnim kontekstom, 5–6 pa uporabo pozivov C s humornim slogom)
To gradivo ima še več datotek. Celoten seznam je na voljo
spodaj.
|
|---|
| Jezik: | Slovenski jezik |
|---|
| Tipologija: | 2.20 - Zaključena znanstvena zbirka raziskovalnih podatkov |
|---|
| Organizacija: | ZRS Koper - Znanstveno-raziskovalno središče Koper / Centro di Ricerche Scientifiche Capodistria
|
|---|
| Povzetek: | Podatki so rezultat pilotne primerjalne raziskave avtorskih in s pomočjo UI generiranih presojevalnih besedil, da bi ugotovili, ali se UI besedila, ki so po lastnostih sorodna izbranim avtorskim presojevalnim besedilom (kolumna, blog), razlikujejo z vidika intenzitete jezika, kar se odraža tudi v rabi besednih intenzitetnih označevalcev (po modelu Mikolič 2020). Namen primerjalne korpusne analize (sicer manjšega delovnega korpusa) avtorskih in umetno generiranih besedil z jezikovnima modeloma ChatGPT-5 (brezplačna verzija) in GaMS-12B-Instruct je ugotoviti, ali je slovenski jezikovni model glede na raznolikost in semantično ustreznost rabe intenzitetnih označevalcev (že) bliže slovenskim avtorskim besedilom v primerjavi z globalnim modelom ChatGPT, kar bi lahko bil eden od kazalnikov jezikovne kompetence.
Za potrebe raziskave je s pomočjo orodja Sketch Engine nastal manjši delovni korpus »Korpus avtorskih in umetno generiranih presojevalnih besedil«, ki je sestavljen iz treh podkorpusov: (1) 12 avtorskih kolumn oz. blogov, (2) 12 besedil, generiranih z jezikovnim modelom ChatGPT in (3) 12 besedil, generiranih s slovenskim modelom GaMS. S pomočjo orodja Sketch Engine so bili identificirani najpogostejši besedni izrazi, ki se v besedilih nastopajo v vlogi intenzitetnih označevalcev (krepilci, šibilci). V analizi smo se omejili na najpogostejše prislove in členke v tej vlogi med prvimi 50 najpogostejšimi prislovi oz. členki na frekvenčni listi korpusnih lem.
Analiza je podala podobne rezultate, kot nekatere študije na anglosaškem gradivu, da obstajajo razlike v rabi intenzitetnih označevalcev med avtorskimi in s ChatGPT-jem generiranimi besedili (pri nas tudi z GaMS-om). Pri avtorskih besedilih se je pokazala večja raznolikost rabljenih izrazov v tej vlogi, zlasti so za avtorska besedila značilni izrazi, ki odražajo subjektivno vrednotenje tvorca, ki pa niso značilni za naša UI generirana besedila. Razlika v pogostosti rabe označevalcev intenzitete se je pokazala tudi pri primerjavi dveh jezikovnih modelov. V stilu besedil ChatGPT izstopa prisotnost izrazov morda, verjetno, lahko in pogosto, ki kažejo na težnjo k previdnemu, zadržanemu in posplošujočemu izražanju (izogibanje premočnim sodbam), kar sicer ni značilnost izbrane vrste presojevalnih besedil (kolumna, blog). Obratno se je pri besedilih modela GaMS pokazala visoka prisotnost izrazov vedno/stalno, najbolj, ki so pomenski presežniki, izrazito malo pa je šibilcev, kar kaže na odločen, okrepljen, a tudi posplošujoč stil (skrajnostno prikazovanje resničnosti). |
|---|
| Ključne besede: | veliki jezikovni modeli, VJM, ChatGPT, GaMS, kolumna in blog, intenziteta jezika, pragmatika in semantika, korpusna analiza |
|---|
| Status publikacije: | Objavljeno |
|---|
| Verzija publikacije: | Objavljena publikacija |
|---|
| Kraj izida: | Koper |
|---|
| Leto izida: | 2026 |
|---|
| Leto izvedbe: | 2026 |
|---|
| PID: | 20.500.12556/DiRROS-31945  |
|---|
| Datum objave v DiRROS: | 19.08.2026 |
|---|
| Število ogledov: | 46 |
|---|
| Število prenosov: | 34 |
|---|
| Metapodatki: |  |
|---|
|
:
|
Kopiraj citat |
|---|
| | | | Objavi na: |  |
|---|
Postavite miškin kazalec na naslov za izpis povzetka. Klik na naslov izpiše
podrobnosti ali sproži prenos. |