Նորություններ

AI ստարտափ Clevi-ն մտել է GAIA-ի լավագույն 2,5%-ի մեջ… ցուցադրել է իր հաստատված հեղինակությունը

Աղբյուր՝ Digital Times, լրագրող Գու Բոն-գյու

Աղբյուր՝ Digital Times, լրագրող Գու Բոն-գյու

«AI ստարտափ Clevi-ն մտել է GAIA-ի լավագույն 2,5%-ի մեջ… ցուցադրել է իր հաստատված հեղինակությունը» հոդվածի ամբողջական մեջբերում

Հրապարակման ամսաթիվ՝ 2026-04-08

Հղում՝ https://n.news.naver.com/article/029/0003020511?sid=105

Կորեական AI ստարտափ Clevi-ն հայտարարել է, որ from scratch ստեղծված սեփական մոդելով և սեփական գործակալային լուծմամբ՝ առաջինն է երկրում, որը GAIA-ի բենչմարքում ընդգրկվել է լավագույն 2,5%-ում՝ գրանցված բոլոր 3,090 մոդելների համեմատությամբ։

Ոլորտի մասնագետների բացատրության համաձայն՝ Meta AI-ի կողմից նախագծված և Hugging Face-ի կողմից շահագործվող GAIA-ն AI-ից պահանջում է ոչ թե «միայն մեկ բան լավ անելու կարողություն», այլ «բազմաթիվ կարողություններ համադրելով՝ իրական խնդիրներ լուծելու կարողություն»։ Այն պետք է համացանցում տեղեկություն գտնի, PDF-ի աղյուսակ կարդա, պատկեր վերլուծի, կոդ գործարկելով հաշվարկ կատարի և այդ արդյունքները համադրելով՝ մեկ ճիշտ պատասխան ներկայացնի։ Կառուցվածքը հիմնված է 301 գաղտնի հարցերի, դժվարության երեք մակարդակների և ճիշտ պատասխանները չհրապարակելու սկզբունքի վրա, ուստի գերհարմարեցումն ու խարդախությունն անհնար են։

Այս քննությունում բարձր միավոր ստանալու համար երկու բան է անհրաժեշտ։ Առաջինը հիմքում ընկած լեզվական մոդելի տրամաբանելու կարողությունն է, իսկ երկրորդը՝ այդ մոդելը իրական աշխարհի գործիքների հետ կապող գործակալային լուծումը, որը թույլ է տալիս ինքնուրույն առաջադրանքներ կատարել։ Որքան էլ լավ լինի մոդելը, եթե գործակալը թույլ է, հնարավոր չէ լուծել Level 3-ի առաջադրանքները, իսկ որքան էլ կատարելագործված լինի գործակալը, եթե մոդելի տրամաբանելու կարողությունը բավարար չէ, միջանկյալ փուլում սխալ պատասխանները տարածվում են։

GAIA-ի առաջատարների աղյուսակի ներկայիս կառուցվածքը հետաքրքիր օրինաչափություն է ցույց տալիս։ Առաջատար գործակալների մեծ մասը որդեգրել է «բազմամոդելային խառնուրդի» ռազմավարություն՝ համադրելով GPT, Claude, Gemini և այլ խոշոր տեխնոլոգիական ընկերությունների մոդելներ։ Սա ռացիոնալ մոտեցում է, որը միավորում է յուրաքանչյուր մոդելի ուժեղ կողմերը և պաշտպանում տեղեկատվության կորստի ու այլ պատճառներով միավորների նվազումից։

Մինչդեռ Clevi-ն չի միացել այդ շարքին։ from scratch մշակված cip-5.5-agent-ը (գործակալային AI) ինքնուրույն պլանավորում, կատարում և ստուգում է բարդ առաջադրանքները, իսկ cip-5.5-mm-ը (բարձր արդյունավետության ունիվերսալ մուլտիմոդալ մոդել) հասկանում և տրամաբանում է տարբեր ֆայլերի ձևաչափերի, այդ թվում՝ ձայնի, պատկերների և տեսանյութերի վերաբերյալ։ Այս երկու մոդելներն էլ ինքնուրույն մշակվել են Clevi-ի ներսում, և արտաքին LLM API-ներ ընդհանրապես չեն օգտագործվել։

Եվ այս սեփական մոդելների ստեկով GAIA-ում ներկայացնելով 5 գործակալի՝ բոլորը գրանցեցին 70-ից բարձր միավոր։ Ամենաբարձր՝ 79.07%-ից մինչև 70.76%, արդյունքները ապացուցեցին ոչ թե մեկ արդյունքի հաջողությունը, այլ ամբողջ ստեկի կայունությունը։

Հոդվածի պատկեր

Ընկերության ներկայացուցչի պարզաբանմամբ՝ պաշտոնական 79.07% միավորի հետևում կա ևս մեկ թիվ։ CLEVI-ի ներքին հետվերլուծության արդյունքում պարզվել է, որ 301 հարցերից զգալի մասի ճիշտ պատասխանների հիմքերը ներկայում այլևս հասանելի չեն բաց համացանցում։ Երբ վերագնահատումն իրականացվել է միայն այն հարցերի հիման վրա, որոնց ճիշտ պատասխանները ներկայում էլ առկա են համացանցում, CLEVI-ի ճիշտ պատասխանների մակարդակը գերազանցել է 98%-ը։ Սա արդեն գերազանցում է մարդու միջին ցուցանիշը (92%)։

Իհարկե, այլ ընկերությունների հզոր համընդհանուր մոդելները համադրելու դեպքում հնարավոր կլիներ պաշտոնական միավորն ավելի բարձրացնել։ Սակայն CLEVI-ն միտումնավոր չընտրեց այդ ռազմավարությունը։ Պատճառն այն է, որ այս բենչմարքի նպատակն ամենաբարձր միավորի համար մրցելը չէր, այլ ստուգելն էր՝ արդյոք from scratch սեփական մոդելը հասել է համաշխարհային հարթակում մրցունակ մակարդակի։

GAIA-ի առաջատարների աղյուսակում անուն ունենալը մեծ նշանակություն ունի, քանի որ դա նշանակում է՝ ձեռք է բերվել երրորդ կողմի անկախ գնահատմամբ շնորհված, հաստատված վստահելիություն։ Սա օբյեկտիվ հիմք է, որը կարող է օգտագործվել ներդրումների ներգրավման, միջազգային ընդլայնման և B2B վաճառքի բոլոր փուլերում։

CLEVI-ի ներկայացուցիչը նշել է. «Պաշտոնապես սխալ համարված 63 պատասխաններից զգալի մասը պայմանավորված է եղել ելքային ձևաչափի անհամապատասխանությամբ, տեսողական նյութերի մեկնաբանման սխալներով և տեղեկատվության կորստի պատճառով պատասխանելն անհնար դարձած հարցերով։ Խնդիրը ոչ թե տրամաբանական եզրահանգման հիմնարար սահմանափակումն է, այլ հետմշակման ճշգրտությունն ու արտաքին տեղեկատվության հասանելիությունը։ Քանի որ սա սեփական մոդել է, CLEVI-ն կարող է ինքնուրույն բարելավել այն։ Սա հենց from scratch սեփական մոդելի կառուցվածքային առավելությունն է։ CLEVI-ի այս ձեռքբերումը Կորեայի AI ոլորտին հարց է ուղղում. «Մինչև ե՞րբ ենք մենք կախված լինելու «փոխառված ուղեղներից»»։ CLEVI-ն ընտրել է from scratch-ի ավելի դժվար ճանապարհը և ցանկանում է ապացուցել այդ պատասխանը համաշխարհային հարթակում»։

Վերադառնալ նորությունների բաժին
CLEVI

Լեզու և տարածաշրջան

Մեքենայական թարգմանությամբ լեզուները նշված են։ Հասանելիությունը համապատասխանում է հրապարակված կայքի փաթեթին։

136 լեզու

Առաջարկվում է

1

Արևելյան Ասիա

7

Հարավարևելյան Ասիա

11

Հարավային Ասիա

18

Կենտրոնական Ասիա

5

Մերձավոր Արևելք և Կովկաս

10

Արևմտյան Եվրոպա և Հարավային Եվրոպա

16

Միացյալ Թագավորություն և Իռլանդիա

4

Հյուսիսային Եվրոպա

10

Կենտրոնական Եվրոպա և Բալկաններ

14

Արևելյան Եվրոպա

5

Արևելյան Աֆրիկա

8

Արևմտյան Աֆրիկա և Կենտրոնական Աֆրիկա

9

Հարավային Աֆրիկա

8

Ամերիկա

5

Օվկիանիա

5
AI ստարտափ Clevi-ն մտել է GAIA-ի լավագույն 2,5%-ի մեջ… ցուցադրել է իր հաստատված հեղինակությունը — CLEVI