ប្រភព៖ អ្នកសារព័ត៌មាន Lee Won-ji ពី Electronic News
ដកស្រង់អត្ថបទពេញ៖ “CLEVI, ពិន្ទុ GAIA 79.07% ជាមួយម៉ូដែលអភិវឌ្ឍដោយខ្លួនឯងពី from scratch... ស្ថិតក្នុងចំណោម 2.5% កំពូលនៃម៉ូដែល 3,090”
កាលបរិច្ឆេទបោះពុម្ពផ្សាយ៖ 2026-04-07
តំណ៖ https://www.etnews.com/20260407000203
cip-5.5-agent·cip-5.5-mm ស្ទាក់ម៉ូដែលឯករាជ្យដែលមានភ្នាក់ងារ 5 នាក់ ភ្នាក់ងារទាំងអស់ទទួលបានពិន្ទុលើស 70
អត្រាចម្លើយត្រឹមត្រូវលើស 98% នៅពេលគិតគូរពីការបាត់បង់ព័ត៌មាន ខ្ពស់ជាងមនុស្ស (92%)
ក្រុមហ៊ុនស្តាតអាប់ AI ‘CLEVI’ បានកត់ត្រាអត្រាចម្លើយត្រឹមត្រូវ 79.07% ក្នុងស្តង់ដារវាស់ស្ទង់ភ្នាក់ងារ AI សកល ‘GAIA’ ដោយប្រើម៉ូដែលអភិវឌ្ឍដោយខ្លួនឯងពី from scratch ហើយបានឈរនៅក្នុងចំណោម 2.5% កំពូល ដោយផ្អែកលើម៉ូដែលដែលបានចុះឈ្មោះសរុប 3,090។
យោងតាមការពន្យល់របស់ឧស្សាហកម្ម GAIA ត្រូវបានវាយតម្លៃថាឆ្លុះបញ្ចាំងយ៉ាងស្មោះត្រង់ពីសមត្ថភាពរបស់ ‘ភ្នាក់ងារ AI ជាក់ស្តែង’ នៅក្នុងទីផ្សារស្តង់ដារវាស់ស្ទង់ AI។ ស្តង់ដារវាស់ស្ទង់នេះត្រូវបានអភិវឌ្ឍរួមគ្នាដោយ Meta AI, HuggingFace និងសាកលវិទ្យាល័យ Paris-Saclay ហើយត្រូវបានប្រកាសជាលើកដំបូងនៅខែវិច្ឆិកា ឆ្នាំ 2023។
ចំណុចសំខាន់បីដែលធ្វើឱ្យ GAIA ខុសពីស្តង់ដារវាស់ស្ទង់ផ្សេងទៀត។ ទីមួយ ដោយសារចម្លើយត្រឹមត្រូវមិនត្រូវបានបង្ហាញជាសាធារណៈ ការសម្របខ្លួនលើទិន្នន័យសាកល្បងមិនអាចធ្វើបានទេ។ ទីពីរ ដោយសារត្រូវការការសន្និដ្ឋានស្មុគស្មាញបែបពហុជំហាន និងពហុម៉ូឌុល ការទទួលបានពិន្ទុខ្ពស់ដោយការផ្គូផ្គងលំនាំសាមញ្ញមិនអាចធ្វើបានទេ។ ទីបី តាមរយៈតារាងចំណាត់ថ្នាក់ផ្លូវការរបស់ HuggingFace ម៉ូដែលជាង 3,090 នៅទូទាំងពិភពលោកប្រកួតប្រជែងក្រោមលក្ខខណ្ឌដូចគ្នា។
សំណុំទិន្នន័យសាកល្បងមានសំណួរសរុប 301។ Level 1 គឺការប្រើឧបករណ៍តែមួយ និងការសន្និដ្ឋានសាមញ្ញ, Level 2 គឺការរួមបញ្ចូលឧបករណ៍ជាច្រើន និងការសន្និដ្ឋានកម្រិតមធ្យម, Level 3 គឺសំណួរដែលមានកម្រិតលំបាកខ្ពស់បំផុត ដែលត្រូវការការរៀបចំផែនការ និងការប្រតិបត្តិរបស់ភ្នាក់ងារចាប់ពី 5 ជំហានឡើងទៅ។ នៅពេលប្រកាសស្តង់ដារវាស់ស្ទង់នេះ ពិន្ទុរបស់ម៉ូដែល GPT (បំពាក់ដោយปลั๊กអ៊ីន) មានប្រហែលត្រឹម 15% ប៉ុណ្ណោះ ហើយបច្ចុប្បន្នក្រុមកំពូលបានលើកកម្ពស់ពិន្ទុរបស់ខ្លួនមកដល់កម្រិត 70~80%។
ក្នុងចំណោមនេះ CLEVI បានសង្កត់ធ្ងន់ថា ចំណុចដែលគួរឱ្យចាប់អារម្មណ៍បំផុតផ្នែកបច្ចេកទេសនៃសមិទ្ធផលនេះ គឺមិនបានប្រើប្រាស់ API របស់ LLM ខាងក្រៅដូចជា GPT, Claude និង Gemini ឡើយ។ លក្ខណៈពិសេសរបស់ CLEVI គឺការប្រើម៉ូដែលពីរដែលបានអភិវឌ្ឍដោយខ្លួនឯងតាមវិធី from scratch។
cip-5.5-agent គឺជាម៉ូដែល AI បែបអេជិន្ទិក ដែលដើរតួជាខួរក្បាលស្នូលនៃបំពង់បង្ហូរភ្នាក់ងារ ដែលរៀបចំផែនការ (planning) អនុវត្ត (execution) និងផ្ទៀងផ្ទាត់ (verification) កិច្ចការស្មុគស្មាញដោយស្វ័យប្រវត្តិ។ cip-5.5-mm គឺជាម៉ូដែលពហុម៉ូឌុលទូទៅដែលមានប្រសិទ្ធភាពខ្ពស់ អាចយល់ និងធ្វើការវែកញែកលើទម្រង់ឯកសារផ្សេងៗ ដូចជា សំឡេង រូបភាព និងវីដេអូ។ ដោយសារសំណួរ GAIA ភាគច្រើនមានធាតុបញ្ចូលដែលមិនមែនជាអត្ថបទ ដូចជា PDF រូបភាព និងឯកសារអូឌីយ៉ូ សមត្ថភាពពហុម៉ូឌុលនេះបានក្លាយជាកត្តាស្នូលនៃការទទួលបានពិន្ទុខ្ពស់។
CLEVI បានដាក់បញ្ចូលការកំណត់រចនាសម្ព័ន្ធភ្នាក់ងារខុសៗគ្នាចំនួន 5 ទៅក្នុង GAIA ដោយផ្អែកលើម៉ូដែលផ្ទៃក្នុងទាំងពីរនេះ ហើយភ្នាក់ងារទាំងអស់ទទួលបានពិន្ទុលើស 70។
យោងតាមការពន្យល់របស់ក្រុមហ៊ុន ការត្រួតពិនិត្យក្រោយការវាយតម្លៃផ្ទៃក្នុងរបស់ CLEVI បានបង្ហាញលទ្ធផលគួរឱ្យចាប់អារម្មណ៍។ ក្នុងចំណោមសំណួរសរុប 301 មានសំណួរមួយចំនួនដែលមូលដ្ឋានភស្តុតាងសម្រាប់ចម្លើយត្រឹមត្រូវបានបាត់បង់ពីគេហទំព័រសាធារណៈបច្ចុប្បន្ន។ នេះមានន័យថា ព័ត៌មានដែលកាលពីមុនអាចផ្ទៀងផ្ទាត់បានតាមអ៊ីនធឺណិត ឬម៉ាស៊ីនស្វែងរក ត្រូវបានលុប ឬកែប្រែ ហើយមិនអាចចូលប្រើបានទៀត។ នៅពេលវាយតម្លៃឡើងវិញក្នុងដែនកំណត់ព័ត៌មានដែលមនុស្សអាចផ្ទៀងផ្ទាត់ជាសាធារណៈបានបច្ចុប្បន្ន អត្រាចម្លើយត្រឹមត្រូវរបស់ CLEVI ត្រូវបានបង្ហាញថាលើស 98%។ នេះគឺជាតួលេខដែលបានលើសមធ្យមភាគរបស់មនុស្ស 92% រួចទៅហើយ។
អ្នកតំណាង CLEVI បានពន្យល់ថា “CLEVI បានកត់ត្រាពិន្ទុ 70+ សម្រាប់ភ្នាក់ងារទាំង 5 ដោយប្រើតែម៉ូដែលផ្ទៃក្នុងដែលបង្កើតពី from scratch និងដំណោះស្រាយភ្នាក់ងារ AI ផ្ទាល់ខ្លួន ដោយគ្មានការលាយបញ្ចូលម៉ូដែលខាងក្រៅ ហើយបានឈានចូលក្នុងចំណោម 2.5% កំពូលនៅក្នុងបេនច្មាកសាធារណៈ។ តាមរយៈការកែលម្អម៉ូដែលផ្ទៃក្នុង និងដំណោះស្រាយភ្នាក់ងាររបស់ខ្លួននាពេលអនាគត ពិន្ទុផ្លូវការក៏ទំនងជាអាចកើនឡើងបន្ថែមទៀត។ សមិទ្ធផលនេះមានសារៈសំខាន់ ដោយសារវាបង្ហាញពី ‘ទំនុកចិត្តដែលបានផ្ទៀងផ្ទាត់’ តាមរយៈការវាស់វែងជាក់ស្តែងក្នុងបេនច្មាកសាធារណៈសកល បង្ហាញពីសមិទ្ធផលដែលផ្អែកលើម៉ូដែលផ្ទៃក្នុងដែលបង្កើតពី from scratch របស់ក្រុមហ៊ុនអភិវឌ្ឍ AI ក្នុងស្រុក មិនមែនជាលទ្ធផលពីការលាយបញ្ចូលម៉ូដែលខាងក្រៅទេ ប៉ុន្តែជាលទ្ធផលនៃជង់ម៉ូដែលឯករាជ្យ ហើយដោយពិចារណាលើការបាត់បង់ព័ត៌មានក្នុងសំណួរមួយចំនួន វាមានតម្លៃសម្រាប់ការបកស្រាយលើសពីពិន្ទុដែលបានបង្ហាញ។”
