Xəbərlər

Clevi, sıfırdan hazırlanmış öz modeli ilə GAIA-da 79.07%... 3,090 model arasında ən yaxşı 2.5%-lik qrupda

Mənbə: Elektron qəzet, müxbir Li Vonci

Mənbə: Elektron qəzet, müxbir Li Vonci

“Clevi, sıfırdan hazırlanmış öz modeli ilə GAIA-da 79.07%... 3,090 model arasında ən yaxşı 2.5%-lik qrupda” məqaləsinin tam mətni

Nəşr tarixi: 2026-04-07

Link: https://www.etnews.com/20260407000203

cip-5.5-agent·cip-5.5-mm eksklüziv model stakında 5 agentin hamısı 70-dən yuxarı nəticə göstərib

Məlumat itkisi nəzərə alındıqda 98%+ düzgün cavab nisbəti, insanları (92%) üstələyir

Əsas məqalənin şəkli

Süni intellekt startapı “Clevi” sıfırdan hazırlanmış öz modelindən istifadə edərək qlobal süni intellekt agenti benchmarkı “GAIA”da 79.07% düzgün cavab nisbəti göstərib və ümumilikdə qeydiyyatdan keçmiş 3,090 model arasında ən yaxşı 2.5%-lik qrupa daxil olub.

Sektorun izahına görə, süni intellekt benchmarkı bazarında GAIA “praktik süni intellekt agentləri”nin bacarıqlarını dəqiq əks etdirməsi ilə qiymətləndirilir. Meta AI, HuggingFace və Paris-Sakle Universiteti tərəfindən birgə hazırlanmış bu benchmark ilk dəfə 2023-cü ilin noyabrında təqdim edilib.

GAIA-nı digər benchmarklardan fərqləndirən üç əsas məqam var. Birincisi, düzgün cavablar açıqlanmadığı üçün həddən artıq uyğunlaşdırma mümkün deyil. İkincisi, çoxaddımlı və multimodal kompleks mühakimə tələb edildiyindən sadə nümunə uyğunlaşdırması ilə yüksək nəticə əldə etmək mümkün deyil. Üçüncüsü, HuggingFace-in rəsmi lider cədvəli vasitəsilə dünya üzrə 3,090-dan çox model eyni şərtlər altında yarışır.

Test dəsti ümumilikdə 301 sualdan ibarətdir. Level 1 tək alətdən istifadə və sadə mühakiməni, Level 2 çoxsaylı alətlərin kombinasiyası və orta səviyyəli mühakiməni, Level 3 isə 5 və ya daha çox mərhələdən ibarət agent planlaşdırması və icrasını tələb edən ən yüksək çətinlikli sualları əhatə edir. Benchmarkın təqdim edildiyi vaxt GPT modelləri (plaginlərlə təchiz olunmuş) təxminən 15% nəticə göstərirdi, hazırda isə lider komandalar bu göstəricini 70–80%-ə çatdırıblar.

Bu kontekstdə Clevi vurğulayıb ki, əldə olunan nəticədə texniki baxımdan ən diqqətçəkən məqam GPT, Claude, Gemini və digər xarici LLM API-lərindən ümumiyyətlə istifadə edilməməsidir. Clevi sıfırdan hazırlanmış və müstəqil şəkildə inkişaf etdirilmiş iki modeldən istifadə edib.

cip-5.5-agent mürəkkəb tapşırıqları müstəqil şəkildə planlaşdıran (planning), icra edən (execution) və yoxlayan (verification) agent boru kəmərinin əsas beyni rolunu oynayan agentik AI modelidir. cip-5.5-mm səs, şəkil, video və digər müxtəlif fayl formatlarını anlayan və onlar üzərində nəticə çıxaran yüksək performanslı universal multimodal modeldir. GAIA suallarının əhəmiyyətli hissəsinə PDF, şəkil, audio faylları kimi qeyri-mətn girişləri daxil olduğuna görə, bu multimodal qabiliyyət yüksək nəticənin əsas amilinə çevrilib.

Clevi bu iki xüsusi model əsasında 5 fərqli agent konfiqurasiyasını GAIA-da təqdim edib və onların hamısı 70-dən yuxarı nəticə göstərib.

Şirkətin açıqlamasına görə, Clevi daxilində aparılan sonrakı araşdırmada maraqlı nəticə aşkarlanıb. Ümumilikdə 301 sualdan bəziləri üzrə düzgün cavabın əsaslandırılması hazırda açıq internetdə mövcud deyil. Keçmişdə onlayn və ya axtarış sistemlərində yoxlanıla bilən məlumatların silindiyi və ya dəyişdirildiyi üçün artıq onlara çıxış mümkün deyil. Hazırda insanların açıq şəkildə yoxlaya bildiyi məlumatlar çərçivəsində yenidən qiymətləndirildikdə, Clevi-nin düzgün cavab faizi 98%-dən yuxarı olub. Bu göstərici artıq insan orta göstəricisi olan 92%-i üstələyir.

Clevi nümayəndəsi belə izah edib: “Clevi xarici modelləri qarışdırmadan, from scratch hazırlanmış xüsusi modelləri və öz AI agent həlləri ilə 5 agentin hamısında 70+ nəticə göstərərək açıq benchmarkda ilk 2,5%-ə daxil olub. Gələcəkdə xüsusi modellərin və agent həllərinin təkmilləşdirilməsi ilə rəsmi balın da daha da yaxşılaşdırılması mümkün görünür. Bu nailiyyət qlobal açıq benchmarkda faktiki ölçülərək ‘təsdiqlənmiş etimadı’ nümayiş etdirməsi, yerli AI inkişaf etdiricisinin from scratch xüsusi model əsaslı nəticəsi olması, xarici modellərin qarışığı deyil, müstəqil model stekinin nəticəsi olması və bəzi suallar üzrə məlumat itkisini nəzərə aldıqda, baldan daha böyük interpretasiya dəyərinə malik olması baxımından böyük əhəmiyyət daşıyır”.

Xəbərlər bölməsinə qayıt
CLEVI

Dil və region

Maşın tərəfindən tərcümə edilmiş dillər işarələnir. Mövcudluq dərc edilmiş sayt paketinə əsaslanır.

136 dil

Tövsiyə olunur

1

Şərqi Asiya

7

Cənub-Şərqi Asiya

11

Cənubi Asiya

18

Mərkəzi Asiya

5

Yaxın Şərq və Qafqaz

10

Qərbi Avropa və Cənubi Avropa

16

Birləşmiş Krallıq və İrlandiya

4

Şimali Avropa

10

Mərkəzi Avropa və Balkanlar

14

Şərqi Avropa

5

Şərqi Afrika

8

Qərbi Afrika və Mərkəzi Afrika

9

Cənubi Afrika

8

Amerika

5

Okeaniya

5
Clevi, sıfırdan hazırlanmış öz modeli ilə GAIA-da 79.07%... 3,090 model arasında ən yaxşı 2.5%-lik qrupda — CLEVI