ዜና

ክሌቪ፣ from scratch የራሱን ሞዴል በመጠቀም በGAIA 79.07%... ከ3,090 ሞዴሎች መካከል በከፍተኛ 2.5% ውስጥ

ምንጭ፦ ኤሌክትሮኒክ ታይምስ፣ ጋዜጠኛ ኢ ዎንግጂ

ምንጭ፦ ኤሌክትሮኒክ ታይምስ፣ ጋዜጠኛ ኢ ዎንግጂ

“ክሌቪ፣ from scratch የራሱን ሞዴል በመጠቀም በGAIA 79.07%... ከ3,090 ሞዴሎች መካከል በከፍተኛ 2.5% ውስጥ” የሚለውን ጽሑፍ ሙሉ በሙሉ መጥቀስ

የታተመበት ቀን፦ 2026-04-07

አገናኝ፦ https://www.etnews.com/20260407000203

cip-5.5-agent·cip-5.5-mm የራሱ ሞዴል ስታክ፣ 5 ኤጀንቶች በሙሉ ከ70 በላይ ነጥብ

የመረጃ መጥፋትን ከግምት ሲያስገባ 98%+ ትክክለኛ መልስ፣ ከሰዎች (92%) የበለጠ

የጽሑፉ ዋና ምስል

የAI ጀማሪ ኩባንያ 'ክሌቪ' from scratch የራሱን ሞዴል በመጠቀም በዓለም አቀፉ የAI ኤጀንት መለኪያ 'GAIA' 79.07% ትክክለኛ መልስ መዝግቧል፤ ከተመዘገቡ 3,090 ሞዴሎች በአጠቃላይ መሠረት በከፍተኛ 2.5% ውስጥ ገብቷል።

በኢንዱስትሪው ማብራሪያ መሠረት፣ በAI መለኪያ ገበያ ውስጥ GAIA የ'ተግባራዊ AI ኤጀንት' ችሎታን በታማኝነት ያንጸባርቃል ተብሎ ይገመገማል። በMeta AI፣ HuggingFace እና በፓሪስ-ሳክሌ ዩኒቨርሲቲ በጋራ የተሰራው ይህ መለኪያ በ2023 ኖቬምበር ለመጀመሪያ ጊዜ ይፋ ሆነ።

GAIAን ከሌሎች መለኪያዎች የሚለዩት ዋና ነጥቦች ሦስት ናቸው። በመጀመሪያ፣ ትክክለኛው መልስ ይፋ ስላልሆነ ከመጠን በላይ ማስማማት አይቻልም። በሁለተኛ፣ ባለብዙ ደረጃ·ባለብዙ ሞዳል ውስብስብ አስተሳሰብን ስለሚጠይቅ በቀላል የንድፍ ማዛመድ ከፍተኛ ውጤት ማግኘት አይቻልም። በሦስተኛ፣ በHuggingFace ኦፊሴላዊ የደረጃ ሰንጠረዥ ከ3,090 በላይ የዓለም ሞዴሎች በተመሳሳይ ሁኔታ ይወዳደራሉ።

የፈተና ስብስቡ በአጠቃላይ 301 ጥያቄዎችን ያካትታል። Level 1 አንድ መሣሪያ መጠቀምን እና ቀላል አስተሳሰብን፣ Level 2 ብዙ መሣሪያዎችን ማጣመርን እና መካከለኛ ደረጃ አስተሳሰብን፣ Level 3 ደግሞ ከ5 ደረጃዎች በላይ ያለውን የኤጀንት ዕቅድ እና አፈጻጸም የሚጠይቁ ከፍተኛ አስቸጋሪ ጥያቄዎችን ያካትታል። መለኪያው በተገለጸበት ወቅት በGPT ሞዴል (ፕላጊን የተገጠመለት) መሠረት ውጤቱ ወደ 15% ገደማ ብቻ ነበር፤ አሁን ግን ከፍተኛ ደረጃ ያላቸው ቡድኖች ወደ 70–80% ከፍ አድርገውታል።

ከእነዚህ መካከል፣ ክሌቪ በዚህ ውጤት ውስጥ በቴክኒክ በጣም ትኩረት ሊሰጠው የሚገባው ነጥብ GPT፣ Claude፣ Gemini እና የመሳሰሉትን የውጭ LLM APIዎች በፍጹም አለመጠቀሙ ነው ብሎ አጽንዖት ሰጥቷል። ክሌቪ from scratch በሚባለው ዘዴ በራሱ ያዳበራቸውን ሁለት ሞዴሎች መጠቀሙ ልዩ ባህሪው ነው።

cip-5.5-agent ውስብስብ ሥራዎችን በራስ-ሰር የሚያቅድ (planning)፣ የሚያስፈጽም (execution) እና የሚያረጋግጥ (verification) የኤጀንት መስመር ዋና አእምሮ ሆኖ የሚሠራ ኤጀንቲክ AI ሞዴል ነው። cip-5.5-mm ደግሞ እንደ ድምፅ፣ ምስል እና ቪዲዮ ያሉ የተለያዩ የፋይል ቅርጸቶችን ተረድቶ የሚመረምር ከፍተኛ አፈጻጸም ያለው አጠቃላይ መልቲሞዳል ሞዴል ነው። ከGAIA ጥያቄዎች ከፍተኛ ቁጥር የሚሆኑት PDF፣ ምስል እና የድምፅ ፋይሎችን ጨምሮ ጽሑፍ ያልሆኑ ግብዓቶችን ስለሚያካትቱ፣ ይህ መልቲሞዳል ችሎታ ከፍተኛ ውጤት ለማስመዝገብ ዋና ምክንያት ሆኗል።

ክሌቪ በእነዚህ ሁለት የራሱ ሞዴሎች ላይ በመመስረት 5 የተለያዩ የኤጀንት ውቅሮችን በGAIA ውድድር አሳትፏል፤ ሁሉም ከ70 በላይ ውጤት አስመዝግበዋል።

የኩባንያው ማብራሪያ እንደሚገልጸው፣ በክሌቪ ውስጥ በተደረገ የኋላ ግምገማ አስደሳች ውጤት ተገኝቷል። ከጠቅላላው 301 ጥያቄዎች መካከል ለአንዳንዶቹ ትክክለኛ መልስ የሚያረጋግጡ ማስረጃዎች በአሁኑ ጊዜ በይፋ በሚገኘው ድረ-ገጽ ላይ ጠፍተዋል። ቀደም ሲል በመስመር ላይ ወይም በፍለጋ ሞተሮች ላይ ማረጋገጥ የሚቻል መረጃ ተሰርዞ ወይም ተቀይሮ ከእንግዲህ ማግኘት የማይቻልበት ሁኔታ ነው። በአሁኑ ጊዜ ሰዎች በይፋ ማረጋገጥ በሚችሉት የመረጃ ወሰን ውስጥ እንደገና ሲገመገም፣ የክሌቪ ትክክለኛነት መጠን ከ98% በላይ ሆኖ ታይቷል። ይህም ከሰዎች አማካይ 92% ቀድሞውኑ ከፍ ያለ አሃዝ ነው።

የክሌቪ ተወካይ “ክሌቪ የውጭ ሞዴሎችን ሳይቀላቀል፣ from scratch የራሱ ሞዴሎችን እና የራሱን AI ኤጀንት መፍትሔዎች ብቻ በመጠቀም፣ በ5ቱም ኤጀንቶች 70+ ውጤት በማስመዝገብ በይፋ በሚገኝ ቤንችማርክ ከላይኛዎቹ 2.5% ውስጥ ገብቷል። ወደፊት የራሱን ሞዴሎችና የኤጀንት መፍትሔዎችን በማሻሻል ይፋዊ ውጤቱንም ተጨማሪ ማሻሻል የሚቻል ይመስላል። ይህ ውጤት በዓለም አቀፍ ይፋዊ ቤንችማርክ በተጨባጭ ተለክቶ ‘የተረጋገጠ እምነት’ ማሳየቱ፣ የአገር ውስጥ AI አበልጻጊ ኩባንያ ከfrom scratch የራሱ ሞዴል መሠረት ላይ ያስመዘገበው ውጤት መሆኑ፣ የውጭ ሞዴሎች ድብልቅ ሳይሆን የገዛ ሞዴል ስታክ ውጤት መሆኑ፣ እንዲሁም በአንዳንድ ጥያቄዎች የመረጃ መጥፋትን ከግምት ውስጥ ስናስገባ ከውጤቱ በላይ የትርጓሜ ዋጋ ያለው መሆኑ በኩል ትልቅ ትርጉም አለው” ሲል ገልጿል።

ወደ ዜና ክፍሉ ተመለስ
CLEVI

ቋንቋ እና ክልል

მანქანურად ნათარგმნი ენები მონიშნულია. ხელმისაწვდომობა გამოქვეყნებულ საიტის პაკეტს შეესაბამება.

136 ቋንቋዎች

የሚመከር

1

ምስራቃዊ እስያ

7

ደቡብ ምስራቅ እስያ

11

ደቡባዊ እስያ

18

መካከለኛው እስያ

5

መካከለኛው ምስራቅ እና ካውካሰስ

10

ምዕራብ አውሮፓ እና ደቡባዊ አውሮፓ

16

ዩናይትድ ኪንግደም እና አየርላንድ

4

ሰሜናዊ አውሮፓ

10

መካከለኛው አውሮፓ እና ባልካን

14

ምስራቅ አውሮፓ

5

ምስራቅ አፍሪካ

8

ምዕራባዊ አፍሪካ እና መካከለኛው አፍሪካ

9

ደቡባዊ አፍሪካ

8

አሜሪካ

5

ኦሺያንያ

5