Булак: Digital Times, журналист Ку Бонгю
«AI стартапы CLEVI, GAIAнын алдыңкы 2,5% курамына кирди… текшерилген ишенимдүүлүгүн көрсөттү» аттуу макаланын толук тексти боюнча цитата
Жарыяланган күнү: 2026-04-08
Шилтеме: https://n.news.naver.com/article/029/0003020511?sid=105
Түштүк Кореялык AI стартапы ‘CLEVI (Clevi)’ from scratch ыкмасы менен түзүлгөн өзүнүн моделин жана өзүнүн агенттик чечимин иштеп чыккан. Компания Түштүк Кореяда биринчи болуп GAIA бенчмаркы боюнча катталган жалпы 3 090 моделдин ичинен алдыңкы 2,5% курамына киргенин билдирди.
Тармак өкүлдөрүнүн түшүндүрмөсүнө ылайык, Meta AI тарабынан иштелип чыгып, Hugging Face тарабынан башкарылган GAIA AIден «бир гана нерсени мыкты аткаруу жөндөмүн» эмес, «бир нече жөндөмдү айкалыштырып, реалдуу көйгөйлөрдү чечүү жөндөмүн» талап кылат. Вебден маалымат таап, PDF ичиндеги таблицаны окуп, сүрөттөрдү талдап, кодду иштетип эсептеп, андан соң жыйынтыктарды бириктирип, бир туура жооп бериши керек. Жашыруун 301 суроо, үч деңгээлдеги татаалдык жана жоопторду ачыкка чыгарбоо принциби ашыкча ыңгайлашууга да, алдамчылыкка да жол бербеген түзүмдү түзөт.
Бул сынакта жогорку упай алуу үчүн эки нерсе керек. Биринчиси — негиз болгон тил моделинин ой жүгүртүү жөндөмү, экинчиси — ошол моделди реалдуу дүйнөдөгү куралдар менен байланыштырып, тапшырмаларды өз алдынча аткарууга мүмкүндүк берген агенттик чечим. Модель канчалык жакшы болбосун, агент алсыз болсо, Level 3 тапшырмаларын чечүү мүмкүн эмес; агент канчалык так болбосун, моделдин ой жүгүртүү жөндөмү жетишсиз болсо, аралык баскычта ката жооптор жайылат.
GAIA лидер тактасынын азыркы түзүмүн караганда, кызыктуу мыйзам ченем байкалат. Алдыңкы орундардагы агенттердин көпчүлүгү GPT, Claude, Gemini сыяктуу бир нече ири технологиялык компаниялардын моделдерин айкалыштырган «көп моделдүү микс» стратегиясын колдонууда. Бул ар бир моделдин күчтүү жактарын бириктирип, маалыматтын жоголушунан улам упайдын төмөндөшүнөн коргонууга багытталган негиздүү ыкма.
Ал эми CLEVI бул катарга кошулган жок. from scratch ыкмасы менен иштелип чыккан cip-5.5-agent (агенттик AI) татаал тапшырмаларды пландаштырууну, аткарууну жана текшерүүнү өз алдынча жүргүзөт, ал эми cip-5.5-mm (жогорку өндүрүмдүү жалпы багыттагы мультимодалдык модель) үн, сүрөт, видео сыяктуу ар түрдүү файл форматтарын түшүнүп, ой жүгүртөт. Бул эки модель тең CLEVIнин ичинде өз алдынча иштелип чыккан жана тышкы LLM API такыр колдонулган эмес.
Бул өз алдынча иштелип чыккан модель стеги менен GAIAга 5 агентти катыштырып, алардын баары 70тен жогору упайга ээ болду. Эң жогорку 79.07%дан 70.76%га чейин болгон жыйынтыктар бир жолку ийгиликтин эмес, бүтүндөй стектин туруктуулугун далилдеди.
Компаниянын түшүндүрмөсүнө ылайык, расмий 79.07% упайдын артында дагы бир көрсөткүч бар. CLEVIнин ички пост-анализинин натыйжасында 301 суроонун ичинен туура жооптун далили азыркы ачык вебде жоголгон суроолор кыйла көп экени аныкталган. Учурда туура жообу вебде бар болгон суроолордун негизинде кайра баалаганда, CLEVIнин туура жоопторунун үлүшү 98%дан ашкан. Бул адамдын орточо көрсөткүчүнөн (92%) эбак жогору.
Албетте, башка компаниялардын күчтүү универсалдуу моделдерин аралаштырганда расмий упайды дагы жогорулатууга болмок. Бирок CLEVI бул стратегияны атайылап тандаган жок. Анткени бул бенчмарктын максаты эң жогорку упай үчүн атаандашуу эмес, from scratch өзүнүн модели дүйнөлүк аренада атаандаша ала турган деңгээлге жеткен-жетпегенин текшерүү болгон.
GAIA лидер тактасында ысымдын чыгышы үчүнчү тарап жүргүзгөн көз карандысыз баалоо тарабынан берилген тастыкталган ишенимге ээ болуу жагынан чоң мааниге ээ. Бул инвестиция тартууда, чет өлкөгө чыгууда жана B2B сатууда колдонула турган объективдүү негиз болуп саналат.
CLEVIнин өкүлү мындай деди: “Расмий түрдө туура эмес деп табылган 63 жооптун кыйла бөлүгү чыгаруу форматынын дал келбестигинен, визуалдык материалдарды чечмелөөдөгү каталардан жана маалымат жоголгонуна байланыштуу жооп берүү мүмкүн болбогон суроолордон келип чыккан. Бул логикалык ой жүгүртүүнүн түпкү чектөөлөрүнө караганда, пост-иштетүүнүн тактыгы жана тышкы маалыматтын жеткиликтүүлүгү маселеси. Модель өзүнө таандык болгондуктан, CLEVI аны өз алдынча жакшырта алат. Бул from scratch өзүнүн моделинин түзүмдүк артыкчылыгы. CLEVIнин бул жетишкендиги Кореянын AI тармагына «Биз дагы канча убакытка чейин “карызга алынган мээге” таяна беребиз?» деген суроону коюуда. CLEVI from scratch кыйыныраак жолду тандап, дүйнөлүк аренада анын жообун далилдөөнү көздөйт”.
