1. Korpusna analiza pripovednega sloga in jezikovne norme v starejši verski periodikiDiana Košir, Tomaž Erjavec, 2025, izvirni znanstveni članek Povzetek: V prispevku je predstavljen postopek izdelave korpusa CVET, ki vsebuje besedila patra Hijacinta Repiča, objavljena v verski reviji Cvetje z vertov sv. Frančiška v obdobju 1881–1916. Korpus je uporabljen kot podlaga za jezikovno in stilistično analizo, opravljeno z orodjem noSketch Engine. Z analizo frekvenčnosti izbranih spremenljivk sta opisana besedišče patra Repiča in njegov pripovedni slog. Nazadnje je na primeru besed tipa bralec/bravec opazovan sinhrono-diahroni in normativni vidik starejšega slovenskega jezika besedil v korpusu. Ključne besede: starejši slovenski jezik, verski tisk, korpusno jezikoslovje, korpusna stilistika, jezikovna norma Objavljeno v DiRROS: 23.12.2025; Ogledov: 893; Prenosov: 344
Celotno besedilo (300,15 KB) Gradivo ima več datotek! Več... |
2. Raziskovalna infrastruktura za jezikovne vire in tehnologije CLARIN.SITomaž Erjavec, 2024, druge monografije in druga zaključena dela Ključne besede: Nacionalni portal odprte znanosti, odprta znanost, institucionalni repozitoriji, projekt Spoznaj, načela odprte znanosti, raziskovalni podatki, uprabljanje podatkov, spletna orodja, infrastruktura, odprti podatki, CLARIN, raziskovalni podatki, jezikovni viri Objavljeno v DiRROS: 05.03.2025; Ogledov: 1461; Prenosov: 564
Celotno besedilo (2,22 MB) Gradivo ima več datotek! Več... |
3. Korpus CVET 1.0 : Izdelava, opis in analiza zbirke starejših besedil v verski periodikiDiana Košir, Tomaž Erjavec, 2024, objavljeni znanstveni prispevek na konferenci Povzetek: V prispevku je predstavljen proces izdelave in jezikoslovnega označevanja korpusa CVET 1.0, ki vsebuje besedila patra Hijacinta Repiča v starejšem slovenskem jeziku, objavljena v verskem glasilu Cvetje z vertov sv. Frančiškav obdobju 1881–1916. Besedila so bila v obliki PDF pridobljena s portala dLib, urejena v urejevalniku Word in nato pretvorjena v zapis TEI. Starejše besedje je bilo z odprtokodnim orodjem za normalizacijo avtomatsko posodobljeno, kar olajša iskanje po korpusu in nadaljnjo analizo gradiva. V članku so izpostavljene nekatere napake, ki so nastale pri posodabljanju in bodo v naslednji verziji korpusa ročno popravljene. Posodobljena besedila so bila nato še avtomatsko jezikoslovno označena z oblikoskladnjo in skladnjo po sistemu Universal Dependencies. Zapis TEI smo pretvorili v več izvedenih formatov in zbirko objavili pod odprto licenco na repozitoriju in konkordančnikih CLARIN.SI, ki so primerni za jezikoslovne analize gradiva. V drugem deluprispevkaje prikazan primer analize avtorjevega pripovednega stila, opravljene s konkordančnikom noSketch Engine, ki temelji na frekvenčnih spremenljivkah najpogostejših in najmanj pogostih besed terključnih besed Ključne besede: starejša slovenščina, verski tisk, TEI, normalizacija, stilistična analiza, leksika Objavljeno v DiRROS: 23.01.2025; Ogledov: 806; Prenosov: 573
Celotno besedilo (21,69 MB) Gradivo ima več datotek! Več... |
4. |
5. |