Novinky
Aktuality zo Slovak Language AI Hubu a slovenského NLP ekosystému.
Sledujte, čo sa deje v slovenskom NLP - nové zdroje, výsledky výskumu a aktivity komunity.
Ako vzniká benchmark pre rozpoznávanie slovenskej reči
Ak chcete vedieť, ako dobre si modely na rozpoznávanie reči (speech-to-text) poradia s angličtinou, odpoveď máte v priebehu minúty. V prípade slovenčiny ste ju donedávna nemali vôbec. Viacjazyčné evaluácie slovenčinu buď úplne vynechávajú, alebo v nich tvorí len zlomok percenta testovacích dát, čo je príliš málo na spoľahlivý záver.
Prvý benchmark rozpoznávania reči pre slovenčinu je dostupný na SLAIH
Na SLAIH zverejňujeme prvý špecializovaný benchmark automatického rozpoznávania reči pre slovenčinu.
SkMTEB: Prvý benchmark pre slovenské embeddingy
SkMTEB — prvý komplexný benchmark pre textové embeddingy v slovenčine — bol prijatý na ACL 2026, jednu z najvýznamnejších svetových konferencií v oblasti spracovania prirodzeného jazyka. Benchmark pokrýva 31 datasetov naprieč 7 typmi úloh a prináša štandard porovnateľný s MTEB pre angličtinu. Za prácou stojí tím z Kempelenovho inštitútu inteligentných technológií (KInIT), Technickej univerzity v Košiciach (TUKE) a Univerzity Komenského v Bratislave (UK) spolu s ďalšími partnermi slovenského AI ekosystému.
Spúšťame Slovak Language AI Hub
Spúšťame Slovak Language AI Hub - centrálne miesto pre datasety, modely a benchmarky pre slovenský jazyk. Naším cieľom je zlepšiť dostupnosť zdrojov a podporiť rozvoj NLP na Slovensku.
Čo je nové v katalógu SLAIH? Päť zdrojov, ktoré sa oplatí pozrieť
Jedným z hlavných cieľov SLAIH je uľahčiť objavovanie kvalitných zdrojov pre umelú inteligenciu a spracovanie prirodzeného jazyka v slovenčine. V tomto článku by sme vám radi predstavili niekoľko nových prírastkov do nášho katalógu, ktoré stoja za pozornosť. Či už vyvíjate aplikácie založené na veľkých jazykových modeloch, pracujete na automatickom rozpoznávaní reči alebo experimentujete s viacjazyčnými modelmi, tieto zdroje by vám rozhodne nemali uniknúť.