Tinubdan: Digital Times, reporter nga si Gu Bon-gyu
Pagsipi sa tibuok artikulo nga “Ang AI startup nga Clevi misulod sa top 2.5% sa GAIA… Nagpakita sa napamatud-ang kredibilidad”
Petsa sa publikasyon: 2026-04-08
Link : https://n.news.naver.com/article/029/0003020511?sid=105
Ang lokal nga AI startup nga ‘Clevi (Clevi)’ nagpahibalo nga, samtang nagtukod kini og kaugalingong modelo ug kaugalingong agent solution nga gihimo from scratch, misulod kini sa top 2.5% sa GAIA benchmark isip unang kompanya sa South Korea, base sa kinatibuk-ang 3,090 ka rehistradong modelo.
Sumala sa mga pagpasabot sa industriya, ang GAIA, nga gidisenyo sa Meta AI ug gipadagan sa Hugging Face, wala mangutana sa AI kon unsa lang ka maayo kini sa ‘usa ka abilidad,’ kondili kon unsa kini ka makahimo sa ‘pagsagol sa daghang abilidad aron masulbad ang tinuod nga mga problema.’ Kinahanglan mangita kini og impormasyon sa web, mobasa sa mga lamesa sulod sa PDF, moanalisa og mga hulagway, modagan og code aron magkalkula, ug maghiusa sa mga resulta aron makahatag og usa ka hustong tubag. Tungod sa 301 ka kompidensiyal nga pangutana, tulo ka lebel sa kalisod, ug prinsipyo nga dili ipadayag ang hustong mga tubag, ang istruktura niini dili magtugot sa overfitting o cheating.
Aron makakuha og taas nga puntos sa maong eksaminasyon, gikinahanglan ang duha ka butang. Una, ang abilidad sa pangatarungan sa language model nga nagsilbing pundasyon, ug ikaduha, ang agent solution nga magkonektar sa maong modelo ngadto sa mga himan sa tinuod nga kalibotan aron kini makapahigayon og mga buluhaton nga awtonomo. Bisan unsa pa ka maayo ang modelo, kon huyang ang agent, dili niini masulbad ang Level 3; ug bisan unsa pa ka sopistikado ang agent, kon kulang ang abilidad sa pangatarungan sa modelo, mokaylap ang sayop nga tubag gikan sa tunga-tungang lebel.
Kon tan-awon ang kasamtangang estruktura sa GAIA leaderboard, makita ang usa ka makaiikag nga sumbanan. Kadaghanan sa mga agent nga anaa sa taas nga ranggo nagsagop sa estratehiya nga ‘multi-model mix,’ diin gihiusa ang daghang big tech nga modelo sama sa GPT, Claude, ug Gemini. Makatarunganon kini nga pamaagi sa pagkombinar sa mga kalig-on sa matag modelo ug pagpanalipod batok sa pagkunhod sa puntos tungod sa pagkawala sa impormasyon ug uban pa.
Apan si Clevi wala miduyog sa maong pundok. Ang cip-5.5-agent (agentic AI) nga gimugna gamit ang pamaagi nga from scratch awtonomong nagplano, nagpatuman, ug nagberipika sa mga komplikadong buluhaton, samtang ang cip-5.5-mm (high-performance general-purpose multimodal) nakasabut ug nakapangatarungan sa nagkalainlaing format sa file sama sa tingog, hulagway, ug video. Kining duha ka modelo independente nga gimugna sulod sa Clevi, ug wala gayod mogamit og external LLM API.
Ug pinaagi niining kaugalingong modelo nga stack, mipasulod sila og 5 ka ahente sa GAIA ug silang tanan nakarekord og 70 puntos pataas. Gikan sa pinakataas nga 79.07% hangtod sa 70.76%, napamatud-an niini ang kalig-on sa tibuok stack, dili lang swerte sa usa ka resulta.
Sumala sa paliwanag sa kompanya, luyo sa opisyal nga iskor nga 79.07% adunay laing numero. Sa internal nga post-review sa Clevi, nakaplagan nga taliwala sa 301 ka pangutana, daghan ang mga pangutana kansang basihan sa hustong tubag nawala na sa kasamtangang publikong web. Sa dihang gi-evaluate pag-usab base lamang sa mga pangutana diin anaa pa sa web ang hustong tubag, ang accuracy rate sa Clevi milapas sa 98%. Kini nga numero mas taas na kay sa average sa tawo (92%).
Siyempre, kung gisagol ang gamhanang general-purpose nga mga modelo sa ubang kompanya, mahimo unta nga mas madugangan pa ang opisyal nga iskor. Apan tinuyo nga wala pilia sa Clevi kana nga estratehiya. Kay ang tumong niining benchmark dili ang kompetisyon alang sa pinakataas nga iskor, kondili ang pagsusi kung ang kaugalingong modelo nga gihimo from scratch nakaabot ba sa lebel nga mahimong makigkompetensiya sa global nga entablado.
Ang pagbutang sa ngalan sa GAIA leaderboard adunay dakong kahulogan tungod kay nagpasabot kini nga nakabaton og napamatud-ang kredibilidad nga gihatag sa independente nga ebalwasyon sa ikatulong partido. Kini mahimong gamiton isip obhetibong basihan sa tanang yugto sa pagpangita og puhunan, pagpalapad sa gawas sa nasod, ug B2B sales.
Miingon ang usa ka representante sa Clevi, “Sa 63 ka opisyal nga sayop nga tubag, daghan niini naggikan sa dili pagtugma sa output format, sayop sa paghubad sa biswal nga materyales, ug mga pangutana nga dili matubag tungod sa pagkawala sa impormasyon. Dili kini sukaranang limitasyon sa lohikal nga pangatarungan, kondili problema sa katukma sa post-processing ug sa pagkaanaa sa eksternal nga impormasyon. Tungod kay kaugalingong modelo kini, ang Clevi mismo ang makapauswag niini. Mao kini ang estruktural nga bentaha sa kaugalingong modelo nga gihimo from scratch. Ang kalampusan sa Clevi niining higayona naghatag og pangutana sa industriya sa AI sa Korea: ‘Hangtod kanus-a kita mosalig sa “hinulamang utok”?’ Gipili sa Clevi ang mas lisod nga dalan sa paghimo from scratch ug gusto niini nga pamatud-an ang tubag sa entablado sa kalibotan.”
