Xəbərlər

AI startapı Clevi, GAIA-nın ilk 2,5%-nə daxil oldu… təsdiqlənmiş etibarlılığını nümayiş etdirir

Mənbə: Digital Times, müxbir Ku Bon-gyu

Mənbə: Digital Times, müxbir Ku Bon-gyu

“AI startapı Clevi, GAIA-nın ilk 2,5%-nə daxil oldu… təsdiqlənmiş etibarlılığını nümayiş etdirir” məqaləsindən tam sitat

Nəşr tarixi 2026-04-08

Link: https://n.news.naver.com/article/029/0003020511?sid=105

Cənubi Koreyanın AI startapı ‘Clevi (Clevi)’ from scratch üsulu ilə hazırladığı öz modelini və öz agent həllini qurduğu bir vaxtda, ölkədə ilk dəfə GAIA benchmarkında qeydiyyatdan keçmiş ümumilikdə 3 090 model arasında ilk 2,5%-ə daxil olduğunu açıqlayıb.

Sənaye nümayəndələrinin izahına görə, Meta AI tərəfindən dizayn edilən və Hugging Face tərəfindən idarə olunan GAIA süni intellektdən “yalnız bir işi yaxşı görmək bacarığı”nı deyil, “bir neçə bacarığı birləşdirərək real problemləri həll etmək bacarığı”nı tələb edir. O, internetdə məlumat tapmalı, PDF-dəki cədvəlləri oxumalı, şəkilləri təhlil etməli, kodu işə salaraq hesablamalar aparmalı və nəticələri birləşdirərək vahid düzgün cavab təqdim etməlidir. 301 məxfi sual, üç çətinlik səviyyəsi və cavabların məxfi saxlanılması prinsipi əsasında qurulduğuna görə, həddən artıq uyğunlaşdırma və fırıldaqçılıq mümkün deyil.

Bu imtahanda yüksək bal toplamaq üçün iki şey lazımdır. Birincisi, əsasını təşkil edən dil modelinin mühakimə yürütmə qabiliyyəti, ikincisi isə həmin modeli real dünyanın alətləri ilə birləşdirərək müstəqil şəkildə tapşırıqları yerinə yetirməsini təmin edən agent həllidir. Model nə qədər yaxşı olsa da, agent zəifdirsə, Level 3-ü həll etmək mümkün deyil; agent nə qədər mükəmməl olsa da, modelin mühakimə yürütmə qabiliyyəti yetərli deyilsə, səhv cavablar ara mərhələdə yayılır.

GAIA lider cədvəlinin hazırkı quruluşuna baxdıqda maraqlı bir nümunə görünür. Üst sıralardakı agentlərin əksəriyyəti GPT, Claude, Gemini və digər böyük texnologiya şirkətlərinin modellərini birləşdirən “çoxmodellli qarışıq” strategiyasını qəbul edib. Bu, hər bir modelin güclü tərəflərini birləşdirmək və məlumat itkisi kimi səbəblərlə balın azalmasının qarşısını almaq üçün məntiqli yanaşmadır.

Bunun əksinə olaraq, Clevi bu sıraya qoşulmayıb. from scratch üsulu ilə hazırlanmış cip-5.5-agent (agentik AI) mürəkkəb tapşırıqların planlaşdırılmasını, icrasını və yoxlanılmasını müstəqil şəkildə həyata keçirir, cip-5.5-mm (yüksək performanslı universal multimodal model) isə səs, şəkil, video və digər müxtəlif fayl formatlarını anlayır və mühakimə yürüdür. Bu iki modelin hər ikisi Clevi daxilində müstəqil şəkildə hazırlanıb və xarici LLM API-lərindən ümumiyyətlə istifadə edilməyib.

Və bu özünəməxsus model steki ilə GAIA-da 5 agenti yarışa çıxararaq, hamısının 70-dən yuxarı nəticə göstərməsinə nail oldu. Ən yüksək 79.07%-dən 70.76%-ə qədər olan nəticələr tək bir nəticənin şansı deyil, bütün stekin sabitliyinin sübut edildiyini göstərir.

Məqalə şəkli

Şirkətin açıqlamasına görə, rəsmi 79.07%-lik balın arxasında daha bir rəqəm var. Clevi-nin daxili post-analizinin nəticələrinə əsasən, 301 sualdan xeyli hissəsinin düzgün cavab sübutlarının hazırda açıq internetdə yoxa çıxdığı müəyyən edilib. Yalnız düzgün cavabı hazırda internetdə mövcud olan suallar əsasında yenidən qiymətləndirildikdə, Clevi-nin düzgün cavab faizi 98%-dən yüksək olub. Bu göstərici artıq insan ortalamasını (92%) geridə qoyur.

Əlbəttə, digər şirkətlərin güclü universal modellərini qarışdırmaqla rəsmi balı daha da yüksəltmək mümkün olardı. Lakin Clevi bu strategiyanı qəsdən seçmədi. Çünki bu bençmarkın məqsədi ən yüksək bal uğrunda rəqabət aparmaq deyil, from scratch öz modelinin qlobal arenada rəqabət edə biləcək səviyyəyə çatıb-çatmadığını yoxlamaq idi.

GAIA liderlər cədvəlində adın yer alması üçüncü tərəfin müstəqil qiymətləndirməsi ilə verilmiş təsdiqlənmiş etibarlılığa sahib olmaq baxımından böyük əhəmiyyət daşıyır. Bu, investisiya cəlbi, xarici bazarlara çıxış və B2B satışlarının bütün mərhələlərində istifadə edilə bilən obyektiv əsasdır.

Clevi nümayəndəsi bildirib: “Rəsmi olaraq səhv hesablanan 63 cavabın əhəmiyyətli hissəsi çıxış formatının uyğunsuzluğu, vizual materialların şərhindəki səhvlər və məlumat itkisi səbəbindən cavablandırılması mümkün olmayan suallardan qaynaqlanıb. Problem məntiqi mühakimənin fundamental məhdudiyyətlərindən çox, sonrakı emalın dəqiqliyi və xarici məlumatların əlçatanlığı ilə bağlıdır. Öz modelimiz olduğu üçün Clevi onu özü təkmilləşdirə bilər. Məhz bu, from scratch öz modelinin struktur üstünlüyüdür. Clevi-nin bu nailiyyəti Koreya AI sənayesinə “Biz nə vaxta qədər ‘borc alınmış beyinlərdən’ asılı qalacağıq?” sualını ünvanlayır. Clevi from scratch kimi daha çətin yolu seçərək, bu cavabı dünya səhnəsində sübut etmək istəyir”.

Xəbərlər bölməsinə qayıt
CLEVI

Dil və region

Maşın tərəfindən tərcümə edilmiş dillər işarələnir. Mövcudluq dərc edilmiş sayt paketinə əsaslanır.

136 dil

Tövsiyə olunur

1

Şərqi Asiya

7

Cənub-Şərqi Asiya

11

Cənubi Asiya

18

Mərkəzi Asiya

5

Yaxın Şərq və Qafqaz

10

Qərbi Avropa və Cənubi Avropa

16

Birləşmiş Krallıq və İrlandiya

4

Şimali Avropa

10

Mərkəzi Avropa və Balkanlar

14

Şərqi Avropa

5

Şərqi Afrika

8

Qərbi Afrika və Mərkəzi Afrika

9

Cənubi Afrika

8

Amerika

5

Okeaniya

5
AI startapı Clevi, GAIA-nın ilk 2,5%-nə daxil oldu… təsdiqlənmiş etibarlılığını nümayiş etdirir — CLEVI