Rasta duomenų išteklių: 2267
Publikuota: 2026-05-07 Atnaujinta: 2026-05-07 Valstybinė maisto ir veterinarijos tarnyba
Duomenų išteklius viešinamas: Taip Brandos lygis:

Duomenų rinkinys apima Lietuvoje registruotų veterinarinių vaistų informaciją, sudarytą remiantis Valstybinės maisto ir veterinarijos tarnybos (VMVT) administruojamu Veterinarinių vaistų registru. Šis registras yra oficialus šaltinis, kuriame kaupiami duomenys apie visus Lietuvoje leidžiamus veterinarinius vaistus – tiek Europos Komisijos centralizuota tvarka registruotus (EU/...), tiek nacionaline tvarka registruotus (LT/...) preparatus.

Apie kiekvieną vaistą rinkinyje pateikiama ši informacija: Sudėtis ir klasifikacija – veikliosios medžiagos pavadinimas lietuvių kalba ir Anatominis terapinis cheminis (ATCvet) klasifikacijos kodas, leidžiantis vaistus grupuoti pagal jų terapinį poveikį ir veikliosios medžiagos savybes. Paskirtis – indikacijos, t. y. ligos ar būklės, kurioms gydyti ar profilaktikai skirtas vaistas; vaisto paskirties gyvūnų rūšys (pvz., šuo, katė, galvijas, kiaulė, arklys, avis); vartojimo būdas (pvz., leisti į raumenis, naudoti su geriamuoju vandeniu) ir išlauka – laikotarpis, per kurį po vaisto vartojimo draudžiama naudoti gyvūno produkciją (mėsą, pieną, kiaušinius), nurodomas atskirai pagal gyvūno rūšį ir produkto tipą. Farmacinė forma – vaisto forma (pvz., tabletė, injekcinis tirpalas, užlašinamasis tirpalas, geriamoji suspensija). Registracijos duomenys – oficialus registracijos numeris; registracijos įsigaliojimo data; registracijos statusas (pvz., galioja, negalioja); vaisto klasifikacija (receptinis ar nereceptinis), registruotojo pavadinimas; šalis ir šalies kodas pagal ISO 3166-1 alfa-2 standartą. Pakuočių informacija – registruotų pakuočių identifikatoriai;, pavadinimai; kiekiai ir vienetų tipai (pvz., tabletė, flakonas, ampulė, pipetė). Vienas vaistas gali turėti kelias registruotas pakuočių formas, kurios išvardintos per kablelį.

Duomenų rinkinys atnaujinamas kiekvieną dieną. Visi duomenys pateikiami atsižvelgiant į teisės aktų keliamus duomenų atvėrimo reikalavimus.

Duomenų teikėjas – Valstybinės maisto ir veterinarijos tarnyba.

Nuoroda į veterinarinių vaistų registrą: https://vetvaistai.vmvt.lt/.

Su duomenimis susijusiais klausimais prašome kreiptis el. paštu atverimas@stat.gov.lt.

Dėl techninių portalo veiklos sutrikimų prašome kreiptis el. paštu atviriduomenys@vssa.lt.

API
63
0
5
Publikuota: 2026-05-07 Atnaujinta: 2026-05-08 Lietuvių kalbos institutas
Duomenų išteklius viešinamas: Taip Brandos lygis:

Duomenyne galima rasti šiuos duomenų rinkinius:

• kalbinių ypatybių pasiskirstymo Lietuvos teritorijoje skaitmeniniai internetiniai žemėlapiai, sudaryti kalbos paveldo duomenų pagrindu. Šie duomenys apima ne mažiau kaip 180 erdvinių duomenų rinkinių: a) skenuotų ir geoorientuotų kalbinių ypatybių paplitimo žemėlapių, b) rekonstruotų kalbinių ypatybių paplitimo vektorinių sluoksnių ir c) sumodeliuotų kalbinių ypatybių paplitimo rastrinių sluoksnių https://atviri-duomenys.lki.lt/search?categories=%252Fcategories%252Fkalbin%25C4%2597s%2520ypatyb%25C4%2597s

• šiuolaikinių kalbinių, sociolingvistinių ir mentalinių duomenų skaitmeniniai internetiniai žemėlapiai, kurių pagrindą sudaro ne mažiau kaip 35 erdvinių duomenų sluoksniai, sukurti remiantis statistiniais gyventojų demografijos, socioekonominių rodiklių ir kalbos gyvybingumo duomenimis. Duomenys surinkti atliekant reprezentatyvias sociolingvistines lietuvių kalbos vartosenos, prestižo, nuostatų, percepcijos, kalbos (kalbų) variantiškumo ir kt. apklausas. Išskiriamos šios duomenų grupės: Percepcija: https://atviri-duomenys.lki.lt/search?categories=%252Fcategories%252Fsociolingvistika Etnolingvistika: https://atviri-duomenys.lki.lt/search?categories=%252Fcategories%252Fetnolingvistika Sociolingvistika: https://atviri-duomenys.lki.lt/search?categories=%252Fcategories%252Fsociolingvistika

• Sociodemografiniai žemėlapiai ir jiems kurti panaudoti erdviniai duomenys, parengti remiantis valstybės įstaigų duomenimis: https://atviri-duomenys.lki.lt/search?categories=%252Fcategories%252Fsociodemografija https://get.data.gov.lt/datasets/gov/lki/2011_gyventoju_surasymas/:ns

Didelės vertės rinkiniai

GDB GEOJSON
45
0
5
Publikuota: 2026-05-07 Atnaujinta: 2026-05-08 Lietuvių kalbos institutas
Duomenų išteklius viešinamas: Taip Brandos lygis:

Bendrąjį lietuvių kalbos paveldo duomenyną sudaro 500 tūkst. vienetų lietuvių kalbos leksikografijos, tarmių ir vardyno medžiagos objektų (kalbos duomenų kortelių). Objektą sudaro skenuotas kortelės vaizdas JPG formatu bei kortelės duomenys XML įraše. Duomenyne skelbiami „Lietuvių kalbos žodyno“ Pagrindinė kartotekos, „Lietuvių kalbos žodyno“ Papildymų kartotekos ir Vietovardžių, surinktų iš gyvosios kalbos, kartotekos duomenys.

XML
27
0
3
Publikuota: 2026-05-06 Atnaujinta: 2026-05-06 Valstybės duomenų agentūra
Duomenų išteklius viešinamas: Taip Brandos lygis:

Lentelėje pateikiami Vilniaus miesto viešojo transporto vairuotojų per pamainą nuvažiuotų kilometrų suma nuo 2019 m. lapkričio mėnesio. Stulpeliuose „darbo_pradzia“ ir „darbo_pabaiga“ nurodomas darbuotojo darbo pradžios ir pabaigos laikas Lietuvos laiku; darbo pradžia gali būti ankstesnė nei reiso pradžia, o darbo pabaiga – vėlesnė nei atvykimas į galutinę maršruto stotelę. Lentelėje taip pat pateikiama naudotų transporto priemonių informacija. Maršruto identifikatorius („marsruto_id“) keičiasi priskiriant naujus tvarkaraščius. Maršrutai pažymėti S, R ir B raidėmis yra specialieji maršrutai (budintys, atsarginiai, rezerviniai). Duomenys atnaujinami kartą per mėnesį.

Duomenų teikėjas – UAB „Vilniaus viešasis transportas“.

Su duomenimis susijusiais klausimais prašome kreiptis el. paštu atverimas@stat.gov.lt.

Dėl techninių portalo veiklos sutrikimų prašome kreiptis el. paštu atviriduomenys@vssa.lt.

API
77
0
6
Publikuota: 2026-04-29 Atnaujinta: 2026-05-06 Valstybinė maisto ir veterinarijos tarnyba
Duomenų išteklius viešinamas: Taip Brandos lygis:

Duomenų rinkinyje pateikiami duomenys iš Valstybinės maisto ir veterinarinės tarnybos (VMVT) Oficialiosios kontrolės informacinės sistemos (OKIS) apie VMVT atliktus patikrinimus veterinarinės kontrolės subjektuose. Viena duomenų rinkinio eilutė atitinka vieną unikalų patikrinimą. Eilutėje nurodomi patikrinimo ir subjekto identifikaciniai numeriai, subjekto teisinė forma, savivaldybė, kurioje atliktas patikrinimas, patikrinimo data, požymiai, nurodantys, ar VMVT informavo apie patikrinimą prieš atvykstant, ar buvo nustatyti pažeidimai, ar po patikrinimo buvo skirta poveikio priemonė. Taip pat nurodomas paskutinio patikrinimo identifikacinis numeris, data ir laikas, kada įrašas buvo sukurtas arba atnaujintas OKIS duomenų bazėje. Duomenys kaupiami nuo 2025-02-01. Duomenų teikėjas – Valstybinė maisto ir veterinarijos tarnyba.

Su duomenimis susijusiais klausimais prašome kreiptis el. paštu atverimas@stat.gov.lt. Dėl techninių portalo veiklos sutrikimų prašome kreiptis el. paštu atviriduomenys@vssa.lt.

API
73
0
6
Publikuota: 2026-04-29 Atnaujinta: 2026-05-06 Valstybinė maisto ir veterinarijos tarnyba
Duomenų išteklius viešinamas: Taip Brandos lygis:

Duomenų rinkinyje pateikiami duomenys iš Valstybinės maisto ir veterinarijos tarnybos (VMVT) Oficialiosios kontrolės informacinės sistemos (OKIS) apie valstybinės veterinarinės kontrolės subjektus. Viena duomenų rinkinio eilutė atitinka vieną unikalų valstybinės veterinarinės kontrolės ūkio subjektą. Eilutėje nurodomas subjekto identifikacinis numeris, pavadinimas, teisinė forma (juridinis / fizinis), veiklos pradžios ir sustabdymo datos, JAR kodas ir jo validavimo stulpelis, subjekto veikla ir veiklos tipas, veterinarinio patvirtinimo numeris, VMVT padalinys, subjekto adresas ir geolokacija, telefono numeris ir elektroninis paštas. Paskutiniai du stulpeliai nurodo įrašo sukūrimo arba atnaujinimo OKIS duomenų bazėje datą. Duomenys kaupiami nuo 2025-02-01. Duomenų teikėjas – Valstybinė maisto ir veterinarijos tarnyba.

Su duomenimis susijusiais klausimais prašome kreiptis el. paštu atverimas@stat.gov.lt. Dėl techninių portalo veiklos sutrikimų prašome kreiptis el. paštu atviriduomenys@vssa.lt.

API
41
0
6
Publikuota: 2026-04-20 Atnaujinta: 2026-08-11 Valstybės skaitmeninių sprendimų agentūra
Duomenų išteklius viešinamas: Taip Brandos lygis:

Anotuotas garsynas, skirtas šnekos sintezės tikslams neuroniniams balsams generuoti ir dirbtinio intelekto technologijų sprendimų poreikių tenkinimui. Šis garsynas - kompleksinis kalbos išteklius, kurį sudaro pagrindinis (šnekos sintezei) ir papildomas (emocinis) garsynai. Anotuotas garsynas – rinkinys, susidedantis iš garso įrašų ir juos atitinkančių tekstinių transkripcijų ir anotacijų. Šnekos sintezei skirtas anotuotas garsynas - aukštos kokybės garsynas, kuris būtinas siekiant sukurti balsus, kurie skamba natūraliai ir gali būti pritaikyti įvairiose srityse – nuo kasdienių užduočių iki specializuotų profesionalių sprendimų. Emocinis anotuotas garsynas - specializuotas kalbos duomenų rinkinys, skirtas rinkti, saugoti ir analizuoti kalbos įrašus, kuriuose yra aiškiai išreikštos skirtingos emocinės būsenos. Šis garsynas apima įrašus, kuriuose kalbėtojai sąmoningai išreiškia emocijas, tokias kaip džiaugsmas, liūdesys, pyktis, baimė, nuostaba. Šie duomenys yra kruopščiai anotuoti pagal emocines kategorijas ir kitus su emocijomis susijusius parametrus, tokius kaip intonacija, tempas, kalbos garsumas ir ritmas.

84
0
13
Publikuota: 2026-04-20 Atnaujinta: 2026-08-11 Valstybės skaitmeninių sprendimų agentūra
Duomenų išteklius viešinamas: Taip Brandos lygis:

Medicinos garsyną sudaro 418 valandų profesionalios medicininės šnekos duomenų, įrašytų realioje medicinos darbo aplinkoje (garso įrašai ir jų anotacijos, įskaitant transkripcijas). Įrašai yra lietuvių kalba, tačiau juose taip pat vartojami lotyniški terminai, naudojami pagal standartinę praktiką. Garsyno turinys yra anonimizuotas ir atspindi medicinos specialistų vartojamą žodyną šeimos medicinos (bendrosios praktikos) ir radiologijos (magnetinio rezonanso tomografijos (MRT), rentgenografijos (rentgeno), kompiuterinės tomografijos (KT), ultragarsinio tyrimo (sonografijos) srityse. Šeimos medicinos ir radiologijos įrašų santykis yra 50% / 50%. Vyrų ir moterų garso įrašų santykis yra 50% / 50%. Kalbėtojai suskirstyti į tris amžiaus grupes pagal balso charakteristikas: jaunatviško, brandaus ir subrendusio balso amžiaus grupės. Garso įrašai pateikiami .wav formatu, anotacijos (įskaitant transkripcijas) pateikiamos .TextGrid, .parquet ir .json formatais. Finansuoja Ekonomikos gaivinimo ir atsparumo didinimo priemonės planas „Naujos kartos Lietuva“ ir NextGenerationEU.

67
0
4
Publikuota: 2026-04-20 Atnaujinta: 2026-08-11 Valstybės skaitmeninių sprendimų agentūra
Duomenų išteklius viešinamas: Taip Brandos lygis:

Tai stambios apimties, plačios teminės aprėpties lietuvių kalbos klausimų–atsakymų porų tekstynas, sukurtas dirbtinio intelekto priemonėmis remiantis viešai prieinama informacija iš įvairių šaltinių, įskaitant administracinių ir viešųjų elektroninių paslaugų portalus, enciklopedinius ir statistinius šaltinius, valstybinių institucijų ir savivaldybių portalus, teisės aktų ir duomenų portalus, naujienų bei žiniasklaidos šaltinius ir vartotojų generuojamą turinį. Tekstynas buvo formuojamas taikant transformacinį generavimo procesą, kurio metu pagal šaltiniuose esančią informaciją buvo automatiškai sukurtos naujos klausimų–atsakymų poros lietuvių kalba. Į galutinį tekstyną nebuvo įtraukti originalūs šaltinių tekstai, jų pilni įrašai ar pirminė jų forma. Tekstyną sudaro tik sugeneruotas turinys, skirtas pokalbių robotų kūrimui, lietuvių kalbos DI sistemų vystymui ir kitų dirbtinio intelekto sprendimų poreikiams Finansuoja Ekonomikos gaivinimo ir atsparumo didinimo priemonės planas „Naujos kartos Lietuva“ ir NextGenerationEU.

44
0
6
Publikuota: 2026-04-20 Atnaujinta: 2026-08-11 Valstybės skaitmeninių sprendimų agentūra
Duomenų išteklius viešinamas: Taip Brandos lygis:

Modelis sukurtas kaip tęstinės lietuvių kalbos modelių plėtros dalis, naudojant Bendrąjį lietuvių kalbos tekstyną ir specialiai šiam modeliui parengtą 32 768 tokenų žodyną (tokenizerį). Sukurtas tyrimams, išankstiniam mokymui nuo nulio ir tolesniam pritaikymui lietuvių kalbos generavimo bei kalbos technologijų užduotyse. Modelio svoriai buvo inicializuoti atsitiktine tvarka, o mokymas vykdytas dviem etapais, naudojant Lietuvių kalbos tekstyno apdorotą variantą, parengtą ilgo konteksto mokymui. Modeliui buvo naudojamas specialiai apmokytas 32 000 tokenų tokenizeris. Turėdamas apie 1,04 mlrd. parametrų ir palaikydamas maksimalų 32 768 tokenų konteksto ilgį, modelis yra pritaikytas efektyviai apdoroti ilgus lietuviškus tekstus ir mišraus domeno turinį. Jis skirtas naudoti kaip bazinis generatyvinis modelis tolesniam papildomam mokymui, domeniniam adaptavimui ir eksperimentams lietuvių kalbos NLP srityje. Pagal nutylėjimą modelis nėra instruktavimui pritaikytas ar specializuotas konkrečioms užduotims. Norint jį taikyti pokalbių sistemoms, santraukų sudarymui, klasifikavimui ar domeniškai specifiniam generavimui, rekomenduojamas papildomas mokymas ir vertinimas. Finansuoja Ekonomikos gaivinimo ir atsparumo didinimo priemonės planas „Naujos kartos Lietuva“ ir NextGenerationEU.

31
0
2
Publikuota: 2026-04-14 Atnaujinta: 2026-08-11 Valstybės skaitmeninių sprendimų agentūra
Duomenų išteklius viešinamas: Taip Brandos lygis:

Duomenų rinkinį sudaro sintetiniai lygiagretūs tekstynai šioms kalbų poroms: lietuvių-anglų, lietuvių-prancūzų ir lietuvių-vokiečių. Tekstynai skirti neuroninių mašininio vertimo ir kitų natūralios kalbos apdorojimo uždavinių sprendimui. Rinkinį sudaro daugiau kaip 3 milijonai lygiagrečių sakinių porų, po daugiau kaip 1 milijoną kiekvienai kalbų porai. Duomenys generuoti taikant kontekstinių šablonų metodą, leidžiantį sistemingai įtraukti įvardintas esybes (pvz., asmenvardžius, vietovardžius, organizacijas ir kt.) bei užtikrinti jų vartojimą įvairiose gramatinėse formose. Papildomai lietuvių-anglų dalyje integruota medicininė terminija, paremta struktūruotais medicinos srities terminų rinkiniais. Kartu pateikiami ir ištekliai, naudoti sintetinių tekstynų generavimui: daugiau kaip 20 tūkst. įvardintų esybių kiekvienai kalbų porai (11 įvardintų esybių kategorijų), taip pat daugiau kaip 50 kontekstinių šablonų kiekvienai kategorijai. Tekstynai pasižymi kontroliuojama struktūra ir lingvistine įvairove, nes sakiniai generuoti iš realių kalbos vartojimo pavyzdžių pagrindu sukurtų šablonų. Duomenys pateikiami lygiagrečia forma, užtikrinant tiesioginį sakinių atitikimą tarp kalbų, ir yra tinkami tiesioginiam naudojimui modelių treniravimui. Rinkinys pateikiamas TXT ir TMX formatais, leidžiančiais naudoti jį tiek mašininio mokymosi aplinkose, tiek vertimo atmintis naudojančioje programinėje įrangoje. Šis išteklius ypač naudingas užduotims, susijusioms su įvardintų esybių ir specializuotos terminijos vertimu, taip pat modelių testavimui ir klaidų analizei.

28
0
17