Ziņas

AI jaunuzņēmums CLEVI iekļuvis GAIA 2,5% labāko vidū… demonstrēta pārbaudīta uzticamība

Avots: Digital Times, reportieris Gu Bon-gyu

Avots: Digital Times, reportieris Gu Bon-gyu

Pilns raksts “AI jaunuzņēmums CLEVI iekļuvis GAIA 2,5% labāko vidū… demonstrēta pārbaudīta uzticamība”

Publicēšanas datums: 2026-04-08

Saite: https://n.news.naver.com/article/029/0003020511?sid=105

Dienvidkorejas AI jaunuzņēmums “CLEVI (Clevi)” paziņoja, ka, izveidojot paša from scratch izstrādātu modeli un paša aģenta risinājumu, tas ir kļuvis par pirmo Dienvidkorejā, kas GAIA etalonā, kurā kopumā reģistrēti 3 090 modeļi, iekļuvis labāko 2,5% vidū.

Nozares skaidrojums liecina, ka GAIA, ko izstrādājis Meta AI un pārvalda Hugging Face, no AI pieprasa nevis “spēju labi paveikt tikai vienu lietu”, bet gan “spēju apvienot vairākas spējas, lai risinātu reālas problēmas”. Tam jāatrod informācija tīmeklī, jāizlasa tabulas PDF failos, jāanalizē attēli, jāpalaiž kods aprēķinu veikšanai un jāapkopo rezultāti, lai sniegtu vienu pareizu atbildi. 301 konfidenciāls jautājums, trīs sarežģītības pakāpes un princips neizpaust pareizās atbildes veido struktūru, kurā nav iespējama ne pārmācīšanās, ne krāpšanās.

Lai šajā pārbaudījumā iegūtu augstu rezultātu, nepieciešamas divas lietas. Pirmkārt, pamatā esošā valodas modeļa spriešanas spējas, un, otrkārt, aģenta risinājums, kas savieno šo modeli ar reālās pasaules rīkiem un ļauj tam autonomi veikt uzdevumus. Lai cik labs būtu modelis, ja aģents ir vājš, Level 3 uzdevumus atrisināt nevar; un, lai cik izsmalcināts būtu aģents, ja modelim trūkst spriešanas spēju, kļūdainas atbildes izplatās jau vidējā līmenī.

Aplūkojot pašreizējo GAIA līderu saraksta struktūru, redzams interesants modelis. Lielākā daļa vadošo aģentu ir pieņēmuši “multimodeļu kombinēšanas” stratēģiju, apvienojot vairākus lielo tehnoloģiju uzņēmumu modeļus, piemēram, GPT, Claude un Gemini. Tā ir racionāla pieeja, kas apvieno katra modeļa stiprās puses un aizsargā pret rezultāta samazināšanos informācijas zuduma dēļ.

Savukārt CLEVI šai rindai nepievienojās. From scratch izstrādātais cip-5.5-agent (agentiskais AI) autonomi veic sarežģītu uzdevumu plānošanu, izpildi un pārbaudi, bet cip-5.5-mm (augstas veiktspējas vispārējas nozīmes multimodālais modelis) saprot un analizē dažādus failu formātus, tostarp audio, attēlus un video. Abi šie modeļi ir neatkarīgi izstrādāti CLEVI iekšienē, un ārējās LLM API vispār netika izmantotas.

Ar šo pašu izstrādāto modeļu steku GAIA sacensībās tika pieteikti 5 aģenti, un visi ieguva vairāk nekā 70 punktus. Rezultāti no augstākā rādītāja — 79,07% — līdz 70,76% pierādīja nevis viena veiksmīga rezultāta, bet visa steka stabilitāti.

Raksta attēls

Saskaņā ar uzņēmuma skaidrojumu aiz oficiālā rezultāta — 79,07% — slēpjas vēl viens skaitlis. CLEVI iekšējā pēcpārbaudē tika konstatēts, ka ievērojamam skaitam no 301 jautājuma pašlaik publiski pieejamajā tīmeklī vairs nav atrodams pareizās atbildes pamatojums. Pārvērtējot tikai tos jautājumus, kuru pareizās atbildes joprojām ir atrodamas tīmeklī, CLEVI precizitāte pārsniedza 98%. Tas jau pārsniedz cilvēku vidējo rādītāju (92%).

Protams, oficiālo rezultātu būtu bijis iespējams vēl uzlabot, kombinējot spēcīgus citu uzņēmumu universālos modeļus. Tomēr CLEVI apzināti neizvēlējās šo stratēģiju. Šī etalona mērķis nebija sacensties par augstāko rezultātu, bet gan pārbaudīt, vai from scratch izstrādāts pašu modelis ir sasniedzis līmeni, kurā tas spēj konkurēt pasaules mērogā.

Tas, ka GAIA līderu sarakstā ir atrodams uzņēmuma nosaukums, ir ļoti nozīmīgi, jo tas apliecina neatkarīga trešās puses novērtējuma piešķirtu un pārbaudītu uzticamību. Tas ir objektīvs pamatojums, ko var izmantot visos posmos — investīciju piesaistē, starptautiskajā paplašināšanā un B2B pārdošanā.

CLEVI pārstāvis norādīja: “Ievērojama daļa no 63 oficiāli nepareizajām atbildēm radās izvades formāta neatbilstības, vizuālo materiālu interpretācijas kļūdu un jautājumu, uz kuriem informācijas zuduma dēļ nebija iespējams atbildēt, dēļ. Tā drīzāk ir pēcapstrādes precizitātes un ārējās informācijas pieejamības problēma, nevis loģiskās spriešanas fundamentāls ierobežojums. Tā kā tas ir pašu modelis, CLEVI var to patstāvīgi uzlabot. Tieši tā ir from scratch izstrādāta pašu modeļa strukturālā priekšrocība. CLEVI sasniegums uzdod Korejas AI nozarei jautājumu: “Cik ilgi mēs būsim atkarīgi no ‘aizgūtām smadzenēm’?” CLEVI ir izvēlējies grūtāko — from scratch — ceļu un vēlas pierādīt atbildi uz šo jautājumu pasaules mērogā,” viņš sacīja.

Atpakaļ uz ziņu telpu
CLEVI

Valoda un reģions

Mašīntulkotās valodas ir atzīmētas. Pieejamība atbilst publicētajai vietnes pakotnei.

136 valodas

Ieteicams

1

Austrumāzija

7

Centrālaustrumāzija

11

Dienvidāzija

18

Centrālāzija

5

Tuvie Austrumi un Kaukāzs

10

Rietumeiropa un Dienvideiropa

16

Apvienotā Karaliste un Īrija

4

Ziemeļeiropa

10

Centrāleiropa un Balkāni

14

Austrumeiropa

5

Austrumāfrika

8

Rietumāfrika un Vidusāfrika

9

Dienvidāfrika

8

Amerika

5

Okeānija

5
AI jaunuzņēmums CLEVI iekļuvis GAIA 2,5% labāko vidū… demonstrēta pārbaudīta uzticamība — CLEVI