Nûçe

Stêrta AI ya Klêvî ket nav %2.5 ya jorîn a GAIA… nîşan da ku baweriya wê ya pejirandî heye

Çavkanî: Digital Times, nivîskar Gu Bon-gyu

Çavkanî: Digital Times, nivîskar Gu Bon-gyu

Jêgirtina tevahiya gotara “Stêrta AI ya Klêvî ket nav %2.5 ya jorîn a GAIA… nîşan da ku baweriya wê ya pejirandî heye”

Dîroka weşandinê 2026-04-08

Girêdan : https://n.news.naver.com/article/029/0003020511?sid=105

Stêrta AI ya navxweyî ‘클레비(Clevi)’ ragihand ku piştî avakirina modela xwe ya ji sifirê û çareseriya ajanê ya xwe, ew bûye yekemîn di welatê de ku di benchmarka GAIA de, li gorî tevahiya 3,090 modelên tomarkirî, ketiye nav %2.5 ya jorîn.

Li gorî ravekirina pîşesaziyê, GAIA, ku ji aliyê Meta AI ve hatiye sêwirandin û ji aliyê Hugging Face ve tê birêvebirin, ji AI ne dipirse ku tenê ‘di yek tiştî de baş be’, lê dipirse ku ‘bi tevhevkirina çend jêhatîbûnan pirsgirêkên rastîn çareser bike’. Divê ew li ser webê agahiyan bibîne, tabloyên di hundirê PDFê de bixwîne, wêneyan analîz bike, kodê bimeşîne û hesab bike, paşê encaman bike yek û bersivek rast pêşkêş bike. Bi 301 pirsên nepenî, sê astên dijwariyê û prensîba nepenîkirina bersivan, avahiya wê nehişt ku ne zêde-guncandin û ne jî xapandin were kirin.

Ji bo wergirtina puaneke bilind di vê testê de, du tişt pêwîstin. Yek, jêhatîbûna suyê ya modela zimanî ya bingehîn; du, çareseriya ajanê ku ew model bi amûrên cîhana rastîn ve girêdide û dihêle ku bi serbixwe karan pêk bîne. Her çiqas model baş be jî, heke ajan qels be, ew nikare Level 3 çareser bike; her çiqas ajan sofîstîke be jî, heke suyê modelê kêm be, bersivên şaş di qonaxa navîn de tên belavkirin.

Dema ku em li avahiya niha ya leaderboarda GAIA dinihêrin, şêwazeke balkêş xuya dibe. Piraniya ajanên di rêza jorîn de stratejiya ‘tevlîheviya çend modelan’ bi kar tînin, ku GPT, Claude, Gemini û modelên din ên teknolojiya mezin tevlihev dikin. Ev nêzîkatiyek maqûl e ji bo tevhevkirina hêzên her modelê û parastina li hember kêm bûna puanan ji ber windabûna agahiyan û hwd.

Lêbelê, 클레비 ne ket nav vê rêzê. cip-5.5-agent (AI ya ajanî), ku bi rêbaza ji sifirê hatiye pêşxistin, planandin, bicihanîn û verastkirina karên tevlihev bi serbixwe dike; cip-5.5-mm (multimodal a giştî ya performansa bilind) jî formantên cuda yên pelan, wek deng, wêne û vîdyoyê, fam dike û suyê dike. Her du model jî di hundirê 클레비 de bi awayekî orîjînal hatine pêşxistin û APIya LLM ya derveyî bi tevahî nehatiye bikaranîn.

Û bi vê staka modela xwe ya taybet, 5 ajan li GAIA pêşkêş kirin û hemû encamên li ser 70 puanan tomar kirin. Ji asta herî bilind a 79.07% heta 70.76%, ev nîşan da ku ne tenê encama yekê bi şansê ye, lê ewlehiya tevahiya stakê ye.

Wêneya naverokê

Li gorî ravekirina pargîdaniyê, li pişt puana fermî ya 79.07% hejmareke din jî heye. Di nirxandina paşîn a hundirîn a CLEVI de, hate dîtin ku ji nav 301 pirsan, hejmareke berbiçav îro li weba vekirî delîla bersiva rast winda kiriye. Dema ku tenê pirsên ku delîla bersiva rastî hîn li ser webê hene ji nû ve hatin nirxandin, rêjeya bersivên rast a CLEVI ji 98% zêdetir bû. Ev hejmar jixwe ji navgîna mirovan a 92% derbas dibe.

Bê guman, ger modelên giştî yên bihêz ên pargîdaniyên din tevlihev bikira, dikaribû puana fermî zêdetir bilind bike. Lê CLEVI bi mebest stratejiya wê hilnebijart. Ji ber ku armanca vê benchmarkê ne pêşbaziya ji bo puana herî bilind bû, lê ew bû ku bê piştrastkirin ka modela xwe ya from scratch dikare li asta pêşbaziyê li qada gerdûnî bigihîje yan na.

Li ser rêza pêşeng a GAIA navê xwe dîtin wateyeke mezin heye, ji ber ku ev nîşan dide ku ew xwedî baweriya piştrastkirî ya ku ji hêla nirxandina serbixwe ya aliyekî sêyemîn ve hatiye dayîn e. Ev bingeheke objektîf e ku dikare di hemû qonaxên peydakirina veberhênanê, ketina bazarên derveyî û firotina B2B de were bikaranîn.

Nûnerê CLEVI got: “Ji nav 63 bersivên fermî yên şaş, piraniya wan ji ber nehevgirtina formata derketinê, xeletiya şîrovekirina materyalên dîtbarî û pirsên ku ji ber windabûna agahiyê bersiva rast nehat dayîn, çêbûn. Ev ne pirsgirêka sînorên bingehîn ên ramana mentiqî ye, lê pirsgirêka rastbûna paşprosesê û gihîştina agahiyên derveyî ye. Ji ber ku ew modela xwe ye, CLEVI dikare bi xwe xwe baştir bike. Ev jî avantajaa strukturel a modela xwe ya from scratch e. Serkeftina vê carê ya CLEVI ji pîşesaziya AI ya Koreyê re vê pirsê dixe pêş: “Em ê heta kengê bi ‘mêjiyên deynkirî’ ve girêdayî bimînin?” CLEVI rêya dijwartir a from scratch hilbijart û dixwaze bersiva wê li qada cîhanî bi îspat bike,” wî ragihand.

Vegere odeya nûçeyan
CLEVI

Ziman û herêm

Zimanên bi wergera makîneyê hatine wergerandin hatine nîşankirin. Berdestbûn li gorî pakêta malperê ya weşandî ye.

136 ziman

Pêşniyarkirî

1

Rojhilatê Asyayê

7

Başûrrojhilatê Asyayê

11

Başûrê Asyayê

18

Asyaya Navîn

5

Rojhilata Navîn û Kafkasya

10

Rojavayê Ewropayê û Başûrê Ewropayê

16

Qiralîyeta Yekbûyî û Îrlanda

4

Bakurê Ewropayê

10

Ewropaya Navîn û Balkan

14

Rojhilatê Ewropayê

5

Rojhilatê Afrîkayê

8

Rojavayê Afrîkayê û Afrîkaya Navîn

9

Başûrê Afrîkayê

8

Amerîka

5

Okyanûsya

5
Stêrta AI ya Klêvî ket nav %2.5 ya jorîn a GAIA… nîşan da ku baweriya wê ya pejirandî heye — CLEVI