Loharano: Digital Times, mpanao gazety Gu Bon-gyu
Fanononana feno ny lahatsoratra hoe “Ny fanombohana AI Clevi dia niditra tao amin’ny 2,5% ambony indrindra amin’ny GAIA… mampiseho ny fahamendrehana voamarina”
Daty namoahana: 2026-04-08
Rohy: https://n.news.naver.com/article/029/0003020511?sid=105
Nilaza ny fanombohana AI ao an-toerana ‘Clevi (Clevi)’ fa, tao anatin’ny nananganany ny maodeliny manokana sy ny vahaolana agent-ny manokana noforonina from scratch, dia niditra voalohany tao amin’ny 2,5% ambony indrindra amin’ny benchmark GAIA, raha 3 090 ny maodely voasoratra rehetra no nanaovana fanasokajiana.
Araka ny fanazavan’ny indostria, ny GAIA, novolavolain’ny Meta AI ary tantanan’ny Hugging Face, dia tsy manontany ny AI momba ny ‘fahaizana manao zavatra iray ihany tsara’, fa momba ny ‘fahaizana manambatra fahaizana maro hamahana olana tena izy’. Tsy maintsy mitady vaovao ao amin’ny tranonkala, mamaky tabilao ao anaty PDF, mandinika sary, mampandeha kaody hanaovana kajy, ary manambatra ireo vokatra mba hanome valiny tokana marina izy. Misy fanontaniana 301 tsy ampahibemaso, ambaratongam-pahasarotana telo, ary fitsipika tsy famoahana ny valiny marina, ka rafitra tsy ahafahana manao overfitting na cheating izany.
Zavatra roa no ilaina hahazoana isa ambony amin’io fitsapana io. Voalohany, ny fahaizan’ny maodely fiteny fototra amin’ny fanjohian-kevitra; faharoa, vahaolana agent mampifandray io maodely io amin’ireo fitaovana amin’ny tontolo tena izy mba hahafahany manao asa tsy miankina. Na dia tsara toy inona aza ny maodely, raha malemy ny agent dia tsy afaka mamaha ny Level 3; ary na dia voadio tsara toy inona aza ny agent, raha tsy ampy ny fahaizan’ny maodely manjohy hevitra dia hiparitaka ny valiny diso manomboka amin’ny dingana afovoany.
Raha jerena ny firafitry ny GAIA leaderboard amin’izao fotoana izao, dia hita ny lamina mahaliana iray. Ny ankamaroan’ireo agent eo amin’ny laharana ambony dia mampiasa paikady ‘multimodel mix’, izay mampifangaro maodely Big Tech maro toy ny GPT, Claude ary Gemini. Fomba fiasa mitombina izany, satria manambatra ny tanjaky ny maodely tsirairay ary miaro amin’ny fihenan’ny isa vokatry ny fahaverezan-kevitra sy ny anton-javatra hafa.
Etsy ankilany, tsy nanatevin-daharana izany i Clevi. Ny cip-5.5-agent (AI agentika), novolavolaina tamin’ny fomba from scratch, dia manatanteraka tsy miankina ny fandrafetana drafitra, fanatanterahana ary fanamarinana asa sarotra; ny cip-5.5-mm (multimodal ankapobeny avo lenta) kosa mahatakatra sy manjohy hevitra amin’ny endrika rakitra maro, toy ny feo, sary ary horonan-tsary. Samy novolavolaina manokana tao anatin’i Clevi ireo maodely roa ireo, ary tsy nampiasa API LLM ivelany mihitsy.
Мөн энэхүү өөрсдийн бүтээсэн модель стекээр GAIA-д 5 агент оролцуулж, бүгд 70-аас дээш оноо авсан. Хамгийн өндөр 79.07%-аас 70.76% хүртэлх үр дүн нь ганц удаагийн азтай тохиолдол бус, нийт стекийн тогтвортой байдлыг баталсан юм.
Компанийн тайлбарласнаар, албан ёсны 79.07%-ийн онооны цаана өөр нэг тоо бий. CLEVI-ийн дотоод дараах шалгалтаар 301 асуултаас одоогоор нээлттэй вебд зөв хариултын нотолгоо нь алга болсон асуултууд нэлээд олон байгааг тогтоосон. Зөв хариулт нь одоо ч вебд байгаа асуултуудаар дахин үнэлэхэд CLEVI-ийн зөв хариултын хувь 98%-иас давсан байна. Энэ нь хүний дундаж үзүүлэлт болох 92%-ийг аль хэдийн давсан тоо юм.
Мэдээж, бусад компанийн хүчирхэг ерөнхий зориулалтын моделийг хослуулсан бол албан ёсны оноог илүү нэмэгдүүлэх боломжтой байсан. Гэвч CLEVI энэ стратегийг зориудаар сонгоогүй. Учир нь энэхүү бенчмаркийн зорилго нь хамгийн өндөр онооны төлөө өрсөлдөх бус, from scratch өөрсдийн модел дэлхийн тавцанд өрсөлдөхүйц түвшинд хүрсэн эсэхийг шалгах явдал байсан юм.
GAIA-ийн тэргүүлэгчдийн самбарт нэр нь бичигдсэн байна гэдэг нь гуравдагч талын хараат бус үнэлгээгээр олгогдсон баталгаатай нэр хүндтэй болсныг илэрхийлдэгээрээ ихээхэн ач холбогдолтой. Энэ нь хөрөнгө оруулалт татах, гадаад зах зээлд нэвтрэх, B2B борлуулалт хийх бүх нөхцөлд ашиглаж болох бодитой нотолгоо болно.
CLEVI-ийн төлөөлөгч “Албан ёсоор буруу хариулсан 63 асуултын нэлээд хэсэг нь гаралтын формат зөрсөн, визуал материал буруу тайлбарласан, мөн мэдээлэл алдагдсаны улмаас зөв хариулах боломжгүй болсон асуултуудаас үүдэлтэй. Энэ нь логик дүгнэлт хийх үндсэн хязгаарлалтаас илүүтэй дараах боловсруулалтын нарийвчлал болон гадаад мэдээллийн хүртээмжийн асуудал юм. Өөрсдийн модел учраас CLEVI өөрөө сайжруулж чадна. Энэ бол from scratch өөрсдийн моделийн бүтцийн давуу тал юм. CLEVI-ийн энэ удаагийн амжилт Солонгосын AI салбарт “Бид хэзээ хүртэл ‘зээлсэн тархи’-нд найдах вэ?” гэсэн асуултыг тавьж байна. CLEVI from scratch гэсэн илүү хүнд замыг сонгож, дэлхийн тавцанд хариултаа нотлохыг зорьж байна” гэжээ.
