Novinky

Aktuality zo Slovak Language AI Hubu a slovenského NLP ekosystému.

Sledujte, čo sa deje v slovenskom NLP - nové zdroje, výsledky výskumu a aktivity komunity.

Ako vzniká benchmark pre rozpoznávanie slovenskej reči

Know-how

Ak chcete vedieť, ako dobre si modely na rozpoznávanie reči (speech-to-text) poradia s angličtinou, odpoveď máte v priebehu minúty. V prípade slovenčiny ste ju donedávna nemali vôbec. Viacjazyčné evaluácie slovenčinu buď úplne vynechávajú, alebo v nich tvorí len zlomok percenta testovacích dát, čo je príliš málo na spoľahlivý záver.

Uverejnené 24. júla 202610 min čítania

Prvý benchmark rozpoznávania reči pre slovenčinu je dostupný na SLAIH

Oznámenie

Na SLAIH zverejňujeme prvý špecializovaný benchmark automatického rozpoznávania reči pre slovenčinu.

Uverejnené 26. júna 20263 min čítania

SkMTEB: Prvý benchmark pre slovenské embeddingy

Oznámenie

SkMTEB — prvý komplexný benchmark pre textové embeddingy v slovenčine — bol prijatý na ACL 2026, jednu z najvýznamnejších svetových konferencií v oblasti spracovania prirodzeného jazyka. Benchmark pokrýva 31 datasetov naprieč 7 typmi úloh a prináša štandard porovnateľný s MTEB pre angličtinu. Za prácou stojí tím z Kempelenovho inštitútu inteligentných technológií (KInIT), Technickej univerzity v Košiciach (TUKE) a Univerzity Komenského v Bratislave (UK) spolu s ďalšími partnermi slovenského AI ekosystému.

Uverejnené 23. júna 20265 min čítania

Spúšťame Slovak Language AI Hub

Oznámenie

Spúšťame Slovak Language AI Hub - centrálne miesto pre datasety, modely a benchmarky pre slovenský jazyk. Naším cieľom je zlepšiť dostupnosť zdrojov a podporiť rozvoj NLP na Slovensku.

Uverejnené 23. júna 20263 min čítania

Čo je nové v katalógu SLAIH? Päť zdrojov, ktoré sa oplatí pozrieť

Oznámenie

Jedným z hlavných cieľov SLAIH je uľahčiť objavovanie kvalitných zdrojov pre umelú inteligenciu a spracovanie prirodzeného jazyka v slovenčine. V tomto článku by sme vám radi predstavili niekoľko nových prírastkov do nášho katalógu, ktoré stoja za pozornosť. Či už vyvíjate aplikácie založené na veľkých jazykových modeloch, pracujete na automatickom rozpoznávaní reči alebo experimentujete s viacjazyčnými modelmi, tieto zdroje by vám rozhodne nemali uniknúť.

Uverejnené 30. júla 20255 min čítania