Novinky

Aktuality zo Slovak Language AI Hubu a slovenského NLP ekosystému.

Sledujte, čo sa deje v slovenskom NLP - nové zdroje, výsledky výskumu a aktivity komunity.

Ako (ne)čítať benchmarky a leaderboardy

Know-how

Je jednoduché spoľahnúť sa na jedno číslo z leaderboardu pri výbere modelu pre váš prípad použitia. Toto číslo však môže skrývať omnoho viac, než ukazuje. Dôležité je pozrieť sa aj na to, akú výpovednú hodnotu majú použité benchmarky a aké schopnosti sa pri nich vyhodnocujú.

Uverejnené 21. augusta 202610 min čítania

Čo je nové v katalógu SLAIH? Päť zdrojov, ktoré sa oplatí pozrieť

Oznámenie

Jedným z hlavných cieľov SLAIH je uľahčiť objavovanie kvalitných zdrojov pre umelú inteligenciu a spracovanie prirodzeného jazyka v slovenčine. V tomto článku by sme vám radi predstavili niekoľko nových prírastkov do nášho katalógu, ktoré stoja za pozornosť. Či už vyvíjate aplikácie založené na veľkých jazykových modeloch, pracujete na automatickom rozpoznávaní reči alebo experimentujete s viacjazyčnými modelmi, tieto zdroje by vám rozhodne nemali uniknúť.

Uverejnené 30. júla 20265 min čítania

Ako vzniká benchmark pre rozpoznávanie slovenskej reči

Know-how

Ak chcete vedieť, ako dobre si modely na rozpoznávanie reči (speech-to-text) poradia s angličtinou, odpoveď máte v priebehu minúty. V prípade slovenčiny ste ju donedávna nemali vôbec. Viacjazyčné evaluácie slovenčinu buď úplne vynechávajú, alebo v nich tvorí len zlomok percenta testovacích dát, čo je príliš málo na spoľahlivý záver.

Uverejnené 24. júla 202610 min čítania

Prvý benchmark rozpoznávania reči pre slovenčinu je dostupný na SLAIH

Oznámenie

Na SLAIH zverejňujeme prvý špecializovaný benchmark automatického rozpoznávania reči pre slovenčinu.

Uverejnené 26. júna 20263 min čítania

SkMTEB: Prvý benchmark pre slovenské embeddingy

Oznámenie

SkMTEB — prvý komplexný benchmark pre textové embeddingy v slovenčine — bol prijatý na ACL 2026, jednu z najvýznamnejších svetových konferencií v oblasti spracovania prirodzeného jazyka. Benchmark pokrýva 31 datasetov naprieč 7 typmi úloh a prináša štandard porovnateľný s MTEB pre angličtinu. Za prácou stojí tím z Kempelenovho inštitútu inteligentných technológií (KInIT), Technickej univerzity v Košiciach (TUKE) a Univerzity Komenského v Bratislave (UK) spolu s ďalšími partnermi slovenského AI ekosystému.

Uverejnené 23. júna 20265 min čítania

Spúšťame Slovak Language AI Hub

Oznámenie

Spúšťame Slovak Language AI Hub - centrálne miesto pre datasety, modely a benchmarky pre slovenský jazyk. Naším cieľom je zlepšiť dostupnosť zdrojov a podporiť rozvoj NLP na Slovensku.

Uverejnené 23. júna 20263 min čítania