Zprávy

AI startup CLEVI se dostal mezi 2,5 % nejlepších v GAIA… prokázal ověřenou důvěryhodnost

Zdroj: Digital Times, reportér Ku Bon-gyu

Zdroj: Digital Times, reportér Ku Bon-gyu

Úplná citace článku „AI startup CLEVI se dostal mezi 2,5 % nejlepších v GAIA… prokázal ověřenou důvěryhodnost“

Datum vydání 8. 4. 2026

Odkaz: https://n.news.naver.com/article/029/0003020511?sid=105

Domácí AI startup „CLEVI“ oznámil, že poté, co od základu vytvořil vlastní model a vybudoval vlastní agentní řešení, se jako první v Jižní Koreji dostal mezi 2,5 % nejlepších v benchmarku GAIA, a to na základě celkem 3 090 registrovaných modelů.

Podle vysvětlení odborníků z oboru se GAIA, kterou navrhla Meta AI a provozuje Hugging Face, neptá AI na „schopnost dělat dobře jednu jedinou věc“, ale na „schopnost kombinovat více dovedností a řešit skutečné problémy“. AI musí najít informace na webu, přečíst tabulku v PDF, analyzovat obrázek, spustit kód pro výpočet a všechny výsledky zpracovat do jediné správné odpovědi. Struktura založená na 301 neveřejných otázkách, třech úrovních obtížnosti a zásadě nezveřejňování správných odpovědí znemožňuje přeučení i podvádění.

K dosažení vysokého skóre v tomto testu jsou zapotřebí dvě věci. První je schopnost uvažování základního jazykového modelu a druhou agentní řešení, které tento model propojí s nástroji reálného světa a umožní mu autonomně provádět úkoly. I kdyby byl model sebelepší, slabý agent nedokáže vyřešit úroveň 3; a i kdyby byl agent sebedůmyslnější, nedostatečná schopnost modelu uvažovat povede k řetězení nesprávných odpovědí již ve středních úrovních.

Současná struktura žebříčku GAIA odhaluje zajímavý vzorec. Většina agentů na předních příčkách přijala strategii „mixu více modelů“, která kombinuje několik modelů velkých technologických společností, jako jsou GPT, Claude a Gemini. Jde o racionální přístup, který spojuje silné stránky jednotlivých modelů a brání poklesu skóre způsobenému například ztrátou informací.

CLEVI se však k tomuto proudu nepřipojil. cip-5.5-agent (agentní AI), vyvinutý od základu, autonomně plánuje, provádí a ověřuje komplexní úkoly, zatímco cip-5.5-mm (vysoce výkonný univerzální multimodální model) rozumí různým formátům souborů, včetně zvuku, obrázků a videa, a provádí nad nimi inference. Oba modely byly nezávisle vyvinuty interně společností CLEVI a nebyla použita žádná externí LLM API.

A s tímto vlastním modelovým stackem nasadila do GAIA pět agentů, přičemž všichni dosáhli skóre nad 70 body. Od nejvyššího výsledku 79,07 % po 70,76 % se prokázala stabilita celého stacku, nikoli jen štěstí při jediném výsledku.

Obrázek v hlavním textu

Podle vysvětlení společnosti se za oficiálním skóre 79,07 % skrývá ještě jedno číslo. Následná interní kontrola CLEVI odhalila, že u značného počtu z 301 otázek již na veřejném webu nelze dohledat podklady potvrzující správnou odpověď. Při přehodnocení pouze na základě otázek, u nichž se správná odpověď stále nachází na webu, dosáhla přesnost CLEVI více než 98 %. To je hodnota, která již překonává lidský průměr (92 %).

Samozřejmě, pokud by byly zkombinovány výkonné univerzální modely jiných společností, bylo by možné oficiální skóre ještě zvýšit. CLEVI však tuto strategii záměrně nezvolila. Cílem tohoto benchmarku totiž nebyla soutěž o nejvyšší skóre, ale ověření, zda vlastní model vytvořený from scratch dosáhl úrovně, na níž může konkurovat na globální scéně.

Umístění jména na žebříčku GAIA má velký význam, protože znamená získání ověřené důvěryhodnosti udělené nezávislým hodnocením třetí strany. Jde o objektivní podklad využitelný ve všech fázích získávání investic, expanze do zahraničí i B2B prodeje.

Zástupce CLEVI uvedl: „Z 63 oficiálně nesprávných odpovědí jich značná část vznikla kvůli nesouladu výstupního formátu, chybám při interpretaci vizuálních materiálů a otázkám, u nichž nebylo možné určit správnou odpověď kvůli ztrátě informací. Nejde o zásadní omezení logického uvažování, ale o problém přesnosti následného zpracování a dostupnosti externích informací. Protože jde o vlastní model, může jej CLEVI sama zlepšovat. To je právě strukturální výhoda vlastního modelu vytvořeného from scratch. Tento úspěch CLEVI staví korejskému AI průmyslu otázku: „Jak dlouho se budeme spoléhat na ‚vypůjčené mozky‘?“ CLEVI si zvolila obtížnější cestu from scratch a chce svou odpověď dokázat na světové scéně,“ dodal.

Zpět do redakce
CLEVI

Jazyk a region

Jazyky přeložené strojově jsou označeny. Dostupnost odpovídá zveřejněnému balíčku webu.

136 jazyků

Doporučeno

1

východní Asie

7

jihovýchodní Asie

11

jižní Asie

18

Střední Asie

5

Blízký východ a Kavkaz

10

západní Evropa a jižní Evropa

16

Spojené království a Irsko

4

severní Evropa

10

Střední Evropa a Balkán

14

východní Evropa

5

východní Afrika

8

západní Afrika a střední Afrika

9

jižní Afrika

8

Amerika

5

Oceánie

5