သတင်း

AI စတားတပ် CLEVI၊ GAIA ၏ ထိပ်တန်း 2.5% သို့ ဝင်ရောက်… အတည်ပြုထားသော ယုံကြည်စိတ်ချရမှုကို ပြသ

ရင်းမြစ်: Digital Times၊ သတင်းထောက် Gu Bon-gyu

ရင်းမြစ်: Digital Times၊ သတင်းထောက် Gu Bon-gyu

“AI စတားတပ် CLEVI၊ GAIA ၏ ထိပ်တန်း 2.5% သို့ ဝင်ရောက်… အတည်ပြုထားသော ယုံကြည်စိတ်ချရမှုကို ပြသ” ဆောင်းပါးအပြည့်အစုံကို ကိုးကားခြင်း

ထုတ်ဝေသည့်ရက်စွဲ 2026-04-08

လင့်ခ် : https://n.news.naver.com/article/029/0003020511?sid=105

ပြည်တွင်း AI စတားတပ် ‘Clevi’ သည် from scratch ဖြင့် ဖန်တီးထားသော ကိုယ်ပိုင်မော်ဒယ်နှင့် ကိုယ်ပိုင်အေးဂျင့်ဖြေရှင်းချက်ကို တည်ဆောက်ထားပြီး၊ ပြည်တွင်း၌ ပထမဆုံးအကြိမ် GAIA benchmark တွင် မှတ်ပုံတင်ထားသော မော်ဒယ်စုစုပေါင်း 3,090 ခုအနက် ထိပ်တန်း 2.5% သို့ ဝင်ရောက်ခဲ့ကြောင်း ကြေညာခဲ့သည်။

လုပ်ငန်းကဏ္ဍ၏ ရှင်းလင်းချက်များအရ Meta AI က ဒီဇိုင်းရေးဆွဲပြီး Hugging Face က လည်ပတ်စီမံသည့် GAIA သည် AI ၏ ‘တစ်ခုတည်းသောအရာကို ကောင်းစွာလုပ်နိုင်စွမ်း’ မဟုတ်ဘဲ ‘စွမ်းရည်အမျိုးမျိုးကို ပေါင်းစပ်၍ လက်တွေ့ပြဿနာများကို ဖြေရှင်းနိုင်စွမ်း’ ကို မေးမြန်းသည်။ ဝဘ်ပေါ်တွင် အချက်အလက်များရှာဖွေခြင်း၊ PDF အတွင်းရှိ ဇယားများကို ဖတ်ခြင်း၊ ပုံများကို ခွဲခြမ်းစိတ်ဖြာခြင်း၊ ကုဒ်ကို လည်ပတ်၍ တွက်ချက်ခြင်းနှင့် ထိုရလဒ်များကို ပေါင်းစပ်ကာ အဖြေတစ်ခုတည်း ထုတ်ပေးခြင်းတို့ကို လုပ်ဆောင်ရသည်။ လျှို့ဝှက်ထားသော မေးခွန်း 301 ခု၊ အဆင့်သုံးဆင့်ပါ အခက်အခဲနှင့် အဖြေများကို မထုတ်ဖော်သည့် မူဝါဒတို့ကြောင့် overfitting လည်း cheating လည်း မဖြစ်နိုင်သော ဖွဲ့စည်းပုံဖြစ်သည်။

ထိုစာမေးပွဲတွင် ရမှတ်မြင့်မားရရှိရန် အရာနှစ်ခု လိုအပ်သည်။ အခြေခံဖြစ်သော ဘာသာစကားမော်ဒယ်၏ ဆင်ခြင်推理နိုင်စွမ်းနှင့် ထိုမော်ဒယ်ကို လက်တွေ့ကမ္ဘာရှိ ကိရိယာများနှင့် ချိတ်ဆက်ကာ ကိုယ်တိုင်အလိုအလျောက် အလုပ်များလုပ်ဆောင်စေသော အေးဂျင့်ဖြေရှင်းချက်တို့ ဖြစ်သည်။ မော်ဒယ်က မည်မျှကောင်းမွန်ပါစေ အေးဂျင့်က အားနည်းလျှင် Level 3 ကို ဖြေရှင်းနိုင်မည်မဟုတ်သကဲ့သို့၊ အေးဂျင့်က မည်မျှပင် ခေတ်မီတိကျပါစေ မော်ဒယ်၏ ဆင်ခြင်推理နိုင်စွမ်း မလုံလောက်လျှင် အလယ်အဆင့်တွင်ပင် အဖြေမှားများ ဆက်လက်ပြန့်ပွားသွားမည်ဖြစ်သည်။

GAIA leaderboard ၏ လက်ရှိဖွဲ့စည်းပုံကို ကြည့်လျှင် စိတ်ဝင်စားဖွယ် ပုံစံတစ်ခုကို တွေ့ရသည်။ ထိပ်တန်းအေးဂျင့်အများစုသည် GPT၊ Claude၊ Gemini စသည့် နည်းပညာကုမ္ပဏီကြီးများ၏ မော်ဒယ်အမျိုးမျိုးကို ပေါင်းစပ်အသုံးပြုသည့် ‘မော်ဒယ်စုံ ရောစပ်မှု’ မဟာဗျူဟာကို လက်ခံကျင့်သုံးနေကြသည်။ မော်ဒယ်တစ်ခုချင်းစီ၏ အားသာချက်များကို ပေါင်းစပ်ပြီး အချက်အလက်ဆုံးရှုံးမှုများကြောင့် ရမှတ်ကျဆင်းခြင်းကို ကာကွယ်ရန် သင့်လျော်သော ချဉ်းကပ်မှုတစ်ရပ်ဖြစ်သည်။

သို့သော် Clevi သည် ထိုအုပ်စုတွင် ပါဝင်ခြင်းမရှိခဲ့ပါ။ from scratch နည်းလမ်းဖြင့် ဖွံ့ဖြိုးထားသော cip-5.5-agent(အေးဂျင့်အခြေပြု AI) သည် ရှုပ်ထွေးသော အလုပ်များ၏ စီမံကိန်းချမှတ်ခြင်း၊ အကောင်အထည်ဖော်ခြင်းနှင့် အတည်ပြုစစ်ဆေးခြင်းတို့ကို ကိုယ်တိုင်အလိုအလျောက် လုပ်ဆောင်ပြီး၊ cip-5.5-mm(စွမ်းဆောင်ရည်မြင့် အထွေထွေ မာလ်တီမိုဒယ်) သည် အသံ၊ ပုံနှင့် ဗီဒီယိုစသည့် ဖိုင်ဖော်မတ်အမျိုးမျိုးကို နားလည်ကာ ဆင်ခြင်推理နိုင်သည်။ ဤမော်ဒယ်နှစ်ခုစလုံးကို Clevi အတွင်း၌ သီးခြားဖန်တီးထားပြီး ပြင်ပ LLM API များကို လုံးဝ အသုံးမပြုခဲ့ပါ။

ထို့အပြင် ဤကိုယ်ပိုင်မော်ဒယ်စတက်ခ်ဖြင့် GAIA တွင် အေးဂျင့် ၅ ခုကို ဝင်ရောက်ယှဉ်ပြိုင်စေခဲ့ပြီး အားလုံးက ၇၀ မှတ်ကျော် ရရှိခဲ့သည်။ အမြင့်ဆုံး ၇၉.၀၇% မှ ၇၀.၇၆% အထိ ရရှိခဲ့ခြင်းသည် တစ်ကြိမ်တည်းသောရလဒ်၏ ကံကောင်းမှုမဟုတ်ဘဲ စတက်ခ်တစ်ခုလုံး၏ တည်ငြိမ်မှုကို သက်သေပြခဲ့ခြင်းဖြစ်သည်။

ဆောင်းပါးအတွင်း ပုံ

ကုမ္ပဏီ၏ ရှင်းလင်းချက်အရ တရားဝင်ရမှတ် ၇၉.၀၇% ၏ နောက်ကွယ်တွင် အခြားကိန်းဂဏန်းတစ်ခုလည်း ရှိသည်။ CLEVI အတွင်းပိုင်း ပြန်လည်သုံးသပ်မှုအရ မေးခွန်း ၃၀၁ ခုအနက် လက်ရှိအများပြည်သူကြည့်ရှုနိုင်သော ဝဘ်ပေါ်တွင် အဖြေမှန်အတွက် အထောက်အထားများ ပျောက်ဆုံးနေသည့် မေးခွန်းများစွာကို တွေ့ရှိခဲ့သည်။ အဖြေမှန်သည် လက်ရှိအချိန်တွင် ဝဘ်ပေါ်၌ ရှိနေသေးသည့် မေးခွန်းများကိုသာ အခြေခံ၍ ပြန်လည်အကဲဖြတ်သောအခါ CLEVI ၏ အဖြေမှန်နှုန်းမှာ ၉၈% ကျော် ရှိခဲ့သည်။ ဤကိန်းဂဏန်းသည် လူသားများ၏ ပျမ်းမျှရလဒ် (၉၂%) ကို ကျော်လွန်ပြီးဖြစ်သည်။

သေချာသည်မှာ အခြားကုမ္ပဏီများ၏ အစွမ်းထက်သော အထွေထွေမော်ဒယ်များကို ပေါင်းစပ်အသုံးပြုခဲ့ပါက တရားဝင်ရမှတ်ကို ပိုမိုမြှင့်တင်နိုင်မည်ဖြစ်သည်။ သို့သော် CLEVI သည် ထိုနည်းလမ်းကို ရည်ရွယ်ချက်ရှိရှိ မရွေးချယ်ခဲ့ပါ။ ယခုစံနှုန်းတိုင်းတာမှု၏ ရည်မှန်းချက်မှာ အမြင့်ဆုံးရမှတ်အတွက် ယှဉ်ပြိုင်ရန်မဟုတ်ဘဲ from scratch ကိုယ်ပိုင်မော်ဒယ်သည် ကမ္ဘာ့စင်မြင့်တွင် ယှဉ်ပြိုင်နိုင်သည့်အဆင့်သို့ ရောက်ရှိပြီလားဆိုသည်ကို အတည်ပြုရန်ဖြစ်သောကြောင့် ဖြစ်သည်။

GAIA ခေါင်းဆောင်စာရင်းတွင် အမည်ပါဝင်လာခြင်းသည် တတိယပါတီ၏ လွတ်လပ်သောအကဲဖြတ်မှုမှ ပေးအပ်သည့် အတည်ပြုထားသော ယုံကြည်စိတ်ချရမှုကို ရရှိထားခြင်းဖြစ်သည့်အတွက် အလွန်အရေးကြီးသည်။ ၎င်းသည် ရင်းနှီးမြှုပ်နှံမှုရယူခြင်း၊ ပြည်ပဈေးကွက်ဝင်ရောက်ခြင်းနှင့် B2B အရောင်းလုပ်ငန်း၏ အဆင့်တိုင်းတွင် အသုံးချနိုင်သည့် ဓမ္မဓိဋ္ဌာန်ကျသော အထောက်အထားတစ်ရပ် ဖြစ်လာသည်။

CLEVI မှ တာဝန်ရှိသူတစ်ဦးက “တရားဝင်အဖြေမှား ၆၃ ခုအနက် အများအပြားမှာ output ဖော်မတ်မကိုက်ညီမှု၊ ရုပ်ပုံဆိုင်ရာအချက်အလက်များကို အဓိပ္ပာယ်ဖွင့်ဆိုရာတွင် ဖြစ်ပေါ်သည့် အမှားများနှင့် အချက်အလက်ပျောက်ဆုံးမှုကြောင့် အဖြေမပေးနိုင်သည့် မေးခွန်းများမှ ဖြစ်ပေါ်လာခြင်းဖြစ်သည်။ ယင်းသည် ယုတ္တိကျိုးကြောင်းဆင်ခြင်မှု၏ အခြေခံကန့်သတ်ချက်ထက် post-processing ၏ တိကျမှုနှင့် ပြင်ပအချက်အလက်များ ရရှိနိုင်မှုဆိုင်ရာ ပြဿနာဖြစ်သည်။ ကိုယ်ပိုင်မော်ဒယ်ဖြစ်သောကြောင့် CLEVI က ကိုယ်တိုင်တိုးတက်အောင် ပြုလုပ်နိုင်သည်။ ဤသည်မှာ from scratch ကိုယ်ပိုင်မော်ဒယ်၏ ဖွဲ့စည်းပုံဆိုင်ရာ အားသာချက်ဖြစ်သည်။ CLEVI ၏ ယခုအောင်မြင်မှုသည် ကိုရီးယား AI လုပ်ငန်းကဏ္ဍအတွက် “ကျွန်ုပ်တို့သည် ‘ငှားရမ်းထားသော ဦးနှောက်များ’ ကို မည်မျှကြာအောင် မှီခိုနေဦးမည်နည်း” ဟူသည့် မေးခွန်းကို ထုတ်ဖော်မေးမြန်းနေသည်။ CLEVI သည် from scratch ဟူသည့် ပိုမိုခက်ခဲသောလမ်းကို ရွေးချယ်ပြီး ကမ္ဘာ့စင်မြင့်တွင် ၎င်း၏အဖြေကို သက်သေပြလိုသည်” ဟု ပြောကြားခဲ့သည်။

သတင်းခန်းသို့ ပြန်သွားရန်
CLEVI

ဘာသာစကားနှင့် ဒေသ

Bahasa yang diterjemahkan oleh mesin ditandakan. Ketersediaan mengikut pakej laman yang diterbitkan.

ဘာသာစကား ၁၃၆ ခု

အကြံပြုထားသည်

1

အရှေ့အာရှ

7

အရှေ့တောင်အာရှ

11

တောင်အာရှ

18

အလယ်အာရှ

5

အလယ်ပိုင်းအရှေ့တိုင်းနှင့် ကော့ကေးဆပ်စ်

10

အနောက် ဥရောပနှင့် တောင်ဥရောပ

16

ယူနိုက်တက်ကင်းဒမ်းနှင့် အိုင်ယာလန်

4

မြောက် ဥရောပ

10

အလယ်ပိုင်းဥရောပနှင့် ဘော်လကန်

14

အရှေ့ ဥရောပ

5

အရှေ့ အာဖရိက

8

အနောက် အာဖရိကနှင့် အလယ် အာဖရိက

9

အာဖရိက တောင်ပိုင်း

8

အမေရိကန်

5

သမုဒ္ဒရာဒေသ

5
AI စတားတပ် CLEVI၊ GAIA ၏ ထိပ်တန်း 2.5% သို့ ဝင်ရောက်… အတည်ပြုထားသော ယုံကြည်စိတ်ချရမှုကို ပြသ — CLEVI