Жаңалықтар

AI стартапы CLEVI GAIA-ның үздік 2,5%-ына кірді… Дәлелденген сенімділігін көрсетті

Дереккөз: Digital Times, тілші Ку Бонгю

Дереккөз: Digital Times, тілші Ку Бонгю

«AI стартапы CLEVI GAIA-ның үздік 2,5%-ына кірді… Дәлелденген сенімділігін көрсетті» мақаласынан толық дәйексөз

Жарияланған күні 2026-04-08

Сілтеме: https://n.news.naver.com/article/029/0003020511?sid=105

Оңтүстік Кореялық AI стартапы ‘CLEVI (Clevi)’ from scratch тәсілімен әзірленген өзіндік моделін және өзіндік агент шешімін құрғанын, сондай-ақ Оңтүстік Кореяда алғаш рет GAIA бенчмаркі бойынша тіркелген жалпы 3 090 модельдің ішінде үздік 2,5%-ына кіргенін хабарлады.

Сала мамандарының түсіндіруінше, Meta AI әзірлеп, Hugging Face басқаратын GAIA AI-дан «бір нәрсені жақсы істеу қабілетін» емес, «бірнеше қабілетті біріктіріп, нақты мәселелерді шешу қабілетін» талап етеді. Ол интернеттен ақпарат тауып, PDF ішіндегі кестелерді оқып, кескіндерді талдап, кодты іске қосып есептеп, нәтижелерді біріктіріп, бір дұрыс жауап ұсынуы керек. 301 құпия сұрақ, үш қиындық деңгейі және жауаптарды жарияламау қағидатына негізделген құрылым артық оқытуды да, алдауды да мүмкін етпейді.

Бұл сынақтан жоғары балл алу үшін екі нәрсе қажет. Біріншісі — негіз болатын тіл моделінің пайымдау қабілеті, екіншісі — сол модельді нақты әлем құралдарымен байланыстырып, тапсырмаларды автономды түрде орындауға мүмкіндік беретін агент шешімі. Модель қаншалықты жақсы болғанымен, агент әлсіз болса, Level 3 тапсырмаларын шешу мүмкін емес; ал агент қаншалықты жетілдірілген болса да, модельдің пайымдау қабілеті жеткіліксіз болса, қателер аралық кезеңнен бастап таралады.

GAIA көшбасшылар тақтасының қазіргі құрылымына қарасақ, қызықты заңдылық байқалады. Үздік агенттердің басым бөлігі GPT, Claude, Gemini сияқты бірнеше ірі технологиялық компания моделін біріктіретін «мультимодельді микс» стратегиясын қолданады. Бұл әр модельдің күшті жақтарын біріктіріп, ақпараттың жоғалуы сияқты себептерден туындайтын баллдың төмендеуіне тосқауыл қоюға бағытталған ұтымды тәсіл.

Алайда CLEVI бұл қатарға қосылған жоқ. from scratch тәсілімен әзірленген cip-5.5-agent (агенттік AI) күрделі тапсырмаларды жоспарлауды, орындауды және тексеруді автономды түрде жүзеге асырады, ал cip-5.5-mm (жоғары өнімді әмбебап мультимодальды модель) аудио, кескін, бейне сияқты әртүрлі файл форматтарын түсініп, пайымдайды. Бұл екі модель де CLEVI ішінде дербес әзірленген және сыртқы LLM API мүлде қолданылмаған.

Осы дербес модельдер стегімен GAIA-ға 5 агентті қатыстырып, барлығы 70-тен жоғары балл жинады. Ең жоғары нәтиже 79,07%-дан 70,76%-ға дейін болды, бұл жекелеген нәтиженің сәттілігі емес, бүкіл стектің тұрақтылығы дәлелденгенін көрсетеді.

Негізгі мәтін суреті

Компанияның түсіндіруінше, ресми 79,07% ұпайының артында тағы бір көрсеткіш бар. CLEVI ішкі пост-аудиті нәтижесінде 301 сұрақтың едәуір бөлігінде қазіргі ашық вебте дұрыс жауаптың негіздемесі жоғалғаны анықталды. Қазіргі таңда дұрыс жауабы вебте бар сұрақтар негізінде қайта бағалағанда, CLEVI-дің дәлдік көрсеткіші 98%-дан жоғары болды. Бұл адамзаттың орташа көрсеткішінен (92%) әлдеқашан жоғары нәтиже.

Әрине, басқа компаниялардың қуатты әмбебап модельдерін араластырғанда, ресми ұпайды одан әрі арттыруға болар еді. Алайда CLEVI бұл стратегияны әдейі таңдамады. Өйткені бұл бенчмарктың мақсаты ең жоғары ұпай үшін бәсекелесу емес, from scratch дербес моделінің әлемдік деңгейде бәсекеге қабілетті деңгейге жеткенін тексеру болды.

GAIA көшбасшылар тақтасында аттың аталуы үшінші тарап жүргізген тәуелсіз бағалаудың нәтижесінде берілген расталған беделге ие болу тұрғысынан үлкен мәнге ие. Бұл инвестиция тарту, шетелге шығу және B2B сатудың барлық кезеңдерінде пайдалануға болатын объективті негіз болады.

CLEVI өкілі: “Ресми түрде қате деп танылған 63 жауаптың едәуір бөлігі шығару форматының сәйкес келмеуінен, визуалды материалдарды түсіндірудегі қателерден және ақпараттың жоғалуына байланысты жауап беру мүмкін болмаған сұрақтардан туындады. Бұл логикалық пайымдаудың түбегейлі шектеуінен гөрі, кейінгі өңдеудің дәлдігі мен сыртқы ақпараттың қолжетімділігіне қатысты мәселе. Дербес модель болғандықтан, CLEVI оны өзі жетілдіре алады. Бұл — from scratch дербес моделінің құрылымдық артықшылығы. CLEVI-дің бұл жетістігі Кореяның AI саласына «Біз қашанға дейін “қарызға алған миға” тәуелді боламыз?» деген сұрақ қояды. CLEVI from scratch деген қиынырақ жолды таңдап, осының жауабын әлемдік сахнада дәлелдеуге ұмтылады”, — деді.

Жаңалықтар бөліміне оралу
CLEVI

Тіл мен аймақ

Машиналық аударылған тілдер белгіленген. Қолжетімділік жарияланған сайт бумасына сәйкес келеді.

136 тіл

Ұсынылады

1

Шығыс Азия

7

Оңтүстік-Шығыс Азия

11

Оңтүстік Азия

18

Орталық Азия

5

Таяу Шығыс және Кавказ

10

Батыс Еуропа және Оңтүстік Еуропа

16

Ұлыбритания және Ирландия

4

Солтүстік Еуропа

10

Орталық Еуропа және Балқан

14

Шығыс Еуропа

5

Шығыс Африка

8

Батыс Африка және Орталық Африка

9

Оңтүстік Африка аймағы

8

Америка

5

Океания

5
AI стартапы CLEVI GAIA-ның үздік 2,5%-ына кірді… Дәлелденген сенімділігін көрсетті — CLEVI