ព័ត៌មាន

សមត្ថភាពប្រកួតប្រជែងដែលមានទិន្នន័យបញ្ជាក់— ភ្នាក់ងារ AI ក្នុងស្រុក សម្រេចបានចំណាត់ថ្នាក់កំពូល 2.5% ក្នុង GAIA Bench

នៅពេលដែល GAIA benchmark ត្រូវបានបង្ហាញជាសាធារណៈជាលើកដំបូង សូម្បីតែ GPT-4 ដែលជាម៉ូដែលមានកម្រិតខ្ពស់បំផុតនៅពេលនោះ ក៏ទទួលបានពិន្ទុត្រឹមប្រហែល 30% ប៉ុណ្ណោះ។ នេះបង្ហាញថា ដោយសារលក្ខណៈរបស់ GAIA ដែលទាមទារការគិតហេតុផលស្មុគស្មាញ ការប្រើប្រាស់ឧបករណ៍ និងការដោះស្រាយបញ្ហាច្រើនដំណាក់កាល លើសពីការឆ្លើយសំណួរធម្មតា AI នៅពេលនោះនៅតែស្ថិតក្នុងដំណាក់កាលដំបូងនៃ “សមត្ថភាពក្នុងការគិត និងអនុវត្ត” …

អត្ថន័យនៃពិន្ទុ GAIA — តើភ្នាក់ងារ AI មានការរីកចម្រើនកម្រិតណា?

នៅពេលដែល GAIA benchmark ត្រូវបានបង្ហាញជាសាធារណៈជាលើកដំបូង សូម្បីតែ GPT-4 ដែលជាម៉ូដែលមានកម្រិតខ្ពស់បំផុតនៅពេលនោះ ក៏ទទួលបានពិន្ទុត្រឹមប្រហែល 30% ប៉ុណ្ណោះ។ នេះបង្ហាញថា ដោយសារលក្ខណៈរបស់ GAIA ដែលទាមទារការគិតហេតុផលស្មុគស្មាញ ការប្រើប្រាស់ឧបករណ៍ និងការដោះស្រាយបញ្ហាច្រើនដំណាក់កាល លើសពីការឆ្លើយសំណួរធម្មតា AI នៅពេលនោះនៅតែស្ថិតក្នុងដំណាក់កាលដំបូងនៃ “សមត្ថភាពក្នុងការគិត និងអនុវត្ត”។

ប៉ុន្តែបច្ចុប្បន្ន ភ្នាក់ងារដែលស្ថិតក្នុងក្រុមកំពូលបានឈានដល់ 92.36%។

ការផ្លាស់ប្តូរនេះមិនមែនគ្រាន់តែជាការកែលម្អសមត្ថភាពប៉ុណ្ណោះទេ។ វាជាសូចនាករបង្ហាញថា AI បានឈានចូលដល់ដំណាក់កាល ‘Agentic AI’ ដែលលើសពីការឆ្លើយសំណួរ ដោយអាចបកស្រាយស្ថានភាព ជ្រើសរើសឧបករណ៍ចាំបាច់ ព្រមទាំងរៀបចំផែនការ និងអនុវត្តជាច្រើនដំណាក់កាលដោយខ្លួនឯង។

ក្នុងរយៈពេលត្រឹមតែប៉ុន្មានឆ្នាំ AI បានវិវត្តពី “ឧបករណ៍បង្កើតចំណេះដឹង” ទៅជា “ភ្នាក់ងារអនុវត្តដែលបំពេញការងារ”។

រូបភាពក្នុងអត្ថបទ

📌 ហើយក្នុងចំណោមក្រុមកំពូល 2.5% នោះ មាន CLEVI

ក្នុងបរិយាកាសប្រកួតប្រជែងសកលនេះ ការដែលភ្នាក់ងាររបស់ CLEVI ដែលបង្កើតឡើងក្នុងប្រទេសកូរ៉េ ត្រូវបានចុះក្នុងចំណាត់ថ្នាក់កំពូល 2.5% នៃតារាងចំណាត់ថ្នាក់ GAIA បានបញ្ជាក់ពីភាពឯករាជ្យផ្នែកបច្ចេកវិទ្យា និងជាករណីដែលបង្ហាញថា ភ្នាក់ងារ AI ដែលបង្កើតឡើងនៅប្រទេសកូរ៉េ អាចប្រកួតប្រជែងបានតាមស្តង់ដារសកល។ នេះមានអត្ថន័យលើសពីតួលេខធម្មតា។ មានន័យថា វាជាសមត្ថភាពបច្ចេកវិទ្យាដែលត្រូវបានផ្ទៀងផ្ទាត់ដោយវត្ថុបំណង តាមរយៈការប្រកួតប្រជែងជាមួយម៉ូដែលរាប់ពាន់ នៅក្នុង benchmark សកលដែលបើកចំហជាសាធារណៈ មិនមែនក្នុងបរិយាកាស demo ជាក់លាក់ណាមួយឡើយ។

ចំណុចសំខាន់ជាងនេះទៀតគឺ សមិទ្ធផលនេះមិនមែនជាលទ្ធផលចៃដន្យរបស់ម៉ូដែលតែមួយនោះទេ ប៉ុន្តែភ្នាក់ងារដែលមានការរចនាខុសៗគ្នា នៅលើ Agent Stack ដូចគ្នា អាចបង្កើតសមត្ថភាពកម្រិតកំពូលបានជាបន្តបន្ទាប់។

និយាយម្យ៉ាងទៀត បច្ចេកវិទ្យារបស់ CLEVI មិនមែនជា “លទ្ធផលល្អតែម្តង” នោះទេ ប៉ុន្តែជាសមត្ថភាពប្រកួតប្រជែងផ្នែករចនាសម្ព័ន្ធដែលអាចធ្វើឡើងវិញបាន និងជាសមត្ថភាពកម្រិតវេទិកាដែលអាចពង្រីកទៅកាន់ឧស្សាហកម្ម និងសេណារីយ៉ូផ្សេងៗ។

រូបភាពក្នុងអត្ថបទ

ដូច្នេះ តើសូចនាករនេះមានន័យដូចម្តេច?

តាមទស្សនៈរបស់អ្នកប្រើប្រាស់ ឧបសគ្គដ៏ធំបំផុតចំពោះការដាក់ឱ្យប្រើប្រាស់ AI គឺសំណួរ "តើយើងពិតជាអាចទុកចិត្ត និងប្រគល់ការងារឱ្យវាបានឬទេ?"

ប្រសិទ្ធភាពដែលត្រូវបានបញ្ជាក់ម្តងហើយម្តងទៀតលើឆាករបស់ភាគីទីបី គឺតារាងចំណាត់ថ្នាក់សាធារណៈសកល មិនមែនជាការបង្ហាញដ៏អស្ចារ្យ ឬឯកសារបង្ហាញរបស់ក្រុមហ៊ុនខ្លួនឯងនោះទេ។ នេះជាចម្លើយដែលមានភាព客观បំផុតចំពោះសំណួរនោះ ហើយមានអត្ថន័យជាក់លាក់ក្នុងបីចំណុច។

ទីមួយ កាត់បន្ថយហានិភ័យនៃការដាក់ឱ្យប្រើប្រាស់

ការភ្ជាប់ AI ដែលមិនទាន់ត្រូវបានផ្ទៀងផ្ទាត់ទៅនឹងការងារផ្ទៃក្នុង គឺជាបន្ទុកដ៏ធ្ងន់សម្រាប់សហគ្រាស។

លទ្ធផលនៅក្នុងស្តង់ដារវាស់វែងដែលមានភាពជឿជាក់ ដូចជា GAIA អាចត្រូវបានប្រើប្រាស់ដោយផ្ទាល់ជាមូលដ្ឋាននៃទំនុកចិត្តក្នុងដំណាក់កាលពិនិត្យបច្ចេកវិទ្យា។

ទីពីរ ធ្វើឱ្យស្វ័យប្រវត្តិកម្មការងារស្មុគស្មាញក្លាយជាការពិត

តួលេខ 2.5% កំពូលមានន័យថា កម្រិតបញ្ញាដែលអាចយល់បរិបទ វាយតម្លៃដោយខ្លួនឯងតាមជំហានជាច្រើន និងបញ្ចប់ការងារបាន លើសពីការងារដដែលៗសាមញ្ញ។

វិស័យការងារដែលរហូតមកដល់ពេលនេះត្រូវបានចាត់ទុកថា "ពិបាកប្រគល់ឱ្យ AI" អាចក្លាយជាគោលដៅនៃស្វ័យប្រវត្តិកម្មជាក់ស្តែងបាន។

ទីបី ធានាសុវត្ថិភាពទិន្នន័យ និងប្រសិទ្ធភាពក្នុងពេលតែមួយ

រចនាសម្ព័ន្ធ Agent Stack ផ្ទាល់ខ្លួនមានន័យថា លំហូរទិន្នន័យមិនចាកចេញទៅខាងក្រៅឡើយ។

អ្នកអាចរួចផុតពីទ្វេមុខចាស់ ដែលតម្រូវឱ្យមានការបោះបង់សុវត្ថិភាព ដើម្បីប្រើប្រាស់ AI ប្រសិទ្ធភាពខ្ពស់។

ជាពិសេស ក្នុងឧស្សាហកម្មដែលមានភាពរសើបខ្ពស់ចំពោះទិន្នន័យ ដូចជា ហិរញ្ញវត្ថុ វេជ្ជសាស្ត្រ និងច្បាប់ រចនាសម្ព័ន្ធនេះក្លាយជាចំណុចខុសគ្នាដ៏សំខាន់។

លទ្ធភាពនៃការបង្កើតរចនាសម្ព័ន្ធឡើងវិញ កំពុងចាប់ផ្តើមត្រូវបានបញ្ជាក់រួចហើយ។

ហើយសមិទ្ធផលរបស់ Agent នីមួយៗដែលត្រូវបានសាងសង់លើរចនាសម្ព័ន្ធនេះ នឹងនាំទៅរកការផ្លាស់ប្តូរជាក់ស្តែងនៅទីកន្លែងធ្វើការក្នុងពេលឆាប់ៗនេះ។

"នៅទីបំផុត ភាពពេញលេញនៃបច្ចេកវិទ្យា ត្រូវបានបំពេញដោយ 'ទំនុកចិត្ត' នៅទីកន្លែងធ្វើការ។"

CLEVI មិនត្រឹមតែផ្តល់ AI ប្រសិទ្ធភាពខ្ពស់ប៉ុណ្ណោះទេ។ ខ្លឹមសាររបស់យើង គឺការកសាង 'ហេដ្ឋារចនាសម្ព័ន្ធដែលអាចអនុវត្តបាន' ដែលបំបែករបាំងសុវត្ថិភាពដែលសហគ្រាសកំពុងប្រឈមមុខ និងអាចបញ្ចប់ការងារជាក់ស្តែងដ៏ស្មុគស្មាញបាន។

ឥឡូវនេះ សូមចាកចេញពីដំណាក់កាលពិចារណាអំពីការដាក់ឱ្យប្រើប្រាស់ ហើយចាប់ផ្តើមបរិយាកាសការងារ AI ដែលមានសុវត្ថិភាព និងមានសមត្ថភាពខ្ពស់ជាមួយ CLEVI។

ក្នុងនាមជាដៃគូដ៏រឹងមាំដែលអ្នកអាចទុកចិត្តប្រគល់ការងារឱ្យបាន យើងនឹងរួមគ្នាបង្កើតនវានុវត្តន៍ជាក់ស្តែងនៅក្នុងប្រតិបត្តិការអាជីវកម្មរបស់អ្នក។

ត្រឡប់ទៅបន្ទប់ព័ត៌មាន
CLEVI

ភាសា និងតំបន់

ភាសាដែលបកប្រែដោយម៉ាស៊ីនត្រូវបានសម្គាល់។ ភាពអាចប្រើបានអាស្រ័យលើកញ្ចប់គេហទំព័រដែលបានបោះពុម្ពផ្សាយ។

ភាសា 136

បានណែនាំ

1

អាស៊ី​ខាង​កើត

7

អាស៊ីអាគ្នេយ៍

11

អាស៊ី​ខាង​ត្បូង

18

អាស៊ី​កណ្ដាល

5

មជ្ឈិមបូព៌ា និងកូកាស៊ុស

10

អឺរ៉ុប​ខាង​លិច និង​អឺរ៉ុប​ខាង​ត្បូង

16

ចក្រភព​អង់គ្លេស និង​អៀរឡង់

4

អឺរ៉ុប​ខាង​ជើង

10

អឺរ៉ុបកណ្ដាល និងបាល់កង់

14

អឺរ៉ុប​ខាង​កើត

5

អាហ្វ្រិកខាងកើត

8

អាហ្វ្រិក​ខាង​លិច និង​អាហ្វ្រិក​កណ្តាល

9

អាហ្វ្រិកភាគខាងត្បូង

8

អាមេរិក

5

អូសេអានី

5
សមត្ថភាពប្រកួតប្រជែងដែលមានទិន្នន័យបញ្ជាក់— ភ្នាក់ងារ AI ក្នុងស្រុក សម្រេចបានចំណាត់ថ្នាក់កំពូល 2.5% ក្នុង GAIA Bench — CLEVI