સમાચાર

AI સ્ટાર્ટઅપ CLEVI, GAIAના ટોચના 2.5%માં પ્રવેશ્યું… પ્રમાણિત વિશ્વસનીયતા દર્શાવી

સ્રોત: ડિજિટલ ટાઇમ્સ, ગુ બોન-ગ્યુ પત્રકાર

સ્રોત: ડિજિટલ ટાઇમ્સ, ગુ બોન-ગ્યુ પત્રકાર

“AI સ્ટાર્ટઅપ CLEVI, GAIAના ટોચના 2.5%માં પ્રવેશ્યું… પ્રમાણિત વિશ્વસનીયતા દર્શાવી” લેખનો સંપૂર્ણ અંશ

પ્રકાશન તારીખ 2026-04-08

લિંક : https://n.news.naver.com/article/029/0003020511?sid=105

કોરિયન AI સ્ટાર્ટઅપ ‘CLEVI (Clevi)’એ from scratch તૈયાર કરેલા પોતાના મોડલ અને પોતાના એજન્ટ સોલ્યુશનનું નિર્માણ કર્યું છે અને જણાવ્યું છે કે તેણે કોરિયામાં પ્રથમ વખત GAIA બેન્ચમાર્કમાં નોંધાયેલા કુલ 3,090 મોડલના આધારે ટોચના 2.5%માં સ્થાન મેળવ્યું છે.

ઉદ્યોગના વર્ણન અનુસાર, Meta AI દ્વારા ડિઝાઇન અને Hugging Face દ્વારા સંચાલિત GAIA, AIને ‘માત્ર એક કાર્ય સારી રીતે કરવાની ક્ષમતા’ નહીં પરંતુ ‘વિવિધ ક્ષમતાઓને જોડીને વાસ્તવિક સમસ્યાઓ ઉકેલવાની ક્ષમતા’ વિશે પ્રશ્ન કરે છે. વેબ પર માહિતી શોધવી, PDFમાંના કોષ્ટકો વાંચવા, છબીઓનું વિશ્લેષણ કરવું, કોડ ચલાવીને ગણતરી કરવી અને તે પરિણામોને સંકલિત કરીને એક સાચો જવાબ રજૂ કરવો આવશ્યક છે. 301 ખાનગી પ્રશ્નો, મુશ્કેલીના ત્રણ સ્તરો અને જવાબો જાહેર ન કરવાની નીતિના આધારે આ માળખું ઓવરફિટિંગ કે ચીટિંગને અશક્ય બનાવે છે.

આ પરીક્ષામાં ઊંચો સ્કોર મેળવવા માટે બે બાબતો જરૂરી છે. એક છે પાયાના ભાષા મોડલની તર્ક કરવાની ક્ષમતા અને બીજી છે તે મોડલને વાસ્તવિક દુનિયાના સાધનો સાથે જોડીને સ્વાયત્ત રીતે કાર્ય કરાવતું એજન્ટ સોલ્યુશન. મોડલ ગમે તેટલું સારું હોય, પરંતુ એજન્ટ નબળું હોય તો Level 3 ઉકેલી શકાતું નથી; અને એજન્ટ ગમે તેટલું સુસજ્જ હોય, પરંતુ મોડલની તર્કશક્તિ અપૂરતી હોય તો મધ્યમ તબક્કાથી ખોટા જવાબો આગળ પ્રસરે છે.

GAIA લીડરબોર્ડની વર્તમાન રચના પર નજર કરતાં એક રસપ્રદ પેટર્ન જોવા મળે છે. ટોચના મોટાભાગના એજન્ટો GPT, Claude અને Gemini જેવા અનેક બિગ ટેક મોડલને જોડતી ‘મલ્ટી-મોડલ મિક્સ’ વ્યૂહરચના અપનાવે છે. દરેક મોડલની શક્તિઓને જોડવી અને માહિતી ગુમાવવાને કારણે થતા સ્કોરના ઘટાડા સામે રક્ષણ મેળવવું એ તર્કસંગત અભિગમ છે.

બીજી તરફ, CLEVI આ પ્રવાહમાં જોડાયું નથી. from scratch પદ્ધતિથી વિકસિત cip-5.5-agent (એજેન્ટિક AI) જટિલ કાર્યોનું આયોજન, અમલ અને ચકાસણી સ્વાયત્ત રીતે કરે છે, જ્યારે cip-5.5-mm (ઉચ્ચ-પ્રદર્શન ધરાવતું સામાન્ય મલ્ટિમોડલ) અવાજ, છબી અને વિડિયો સહિત વિવિધ ફાઇલ ફોર્મેટને સમજે છે અને તર્ક કરે છે. આ બંને મોડલ CLEVIની અંદર સ્વતંત્ર રીતે વિકસાવવામાં આવ્યા છે અને કોઈપણ બાહ્ય LLM APIનો ઉપયોગ કરવામાં આવ્યો નથી.

અને આ ઓનર મોડેલ સ્ટેક સાથે GAIAમાં 5 એજન્ટ્સ રજૂ કરીને, બધાએ 70થી વધુ સ્કોર નોંધાવ્યો. સર્વોચ્ચ 79.07%થી 70.76% સુધીના પરિણામોએ સાબિત કર્યું કે આ કોઈ એકલ પરિણામનું નસીબ નહીં, પરંતુ સમગ્ર સ્ટેકની સ્થિરતા છે.

મુખ્ય લેખની છબી

કંપનીના જણાવ્યા અનુસાર, સત્તાવાર 79.07% સ્કોર પાછળ પણ એક બીજો આંકડો છે. CLEVIની આંતરિક પોસ્ટ-રિવ્યૂમાં જાણવા મળ્યું કે 301 પ્રશ્નોમાંથી નોંધપાત્ર સંખ્યામાં પ્રશ્નોના સાચા જવાબના પુરાવા હાલમાં જાહેર વેબ પર ઉપલબ્ધ નથી. હાલમાં પણ સાચા જવાબો વેબ પર ઉપલબ્ધ હોય તેવા પ્રશ્નોના આધારે પુનર્મૂલ્યાંકન કરતાં, CLEVIનો સાચા જવાબોનો દર 98%થી વધુ હતો. આ આંકડો માનવ સરેરાશ (92%)ને પહેલેથી જ વટાવી ગયો છે.

અલબત્ત, અન્ય કંપનીઓના શક્તિશાળી સામાન્ય મોડેલોને મિશ્રિત કર્યા હોત તો સત્તાવાર સ્કોર વધુ ઊંચો લાવી શકાયો હોત. પરંતુ CLEVIએ ઇરાદાપૂર્વક આ વ્યૂહરચના અપનાવી નહોતી. કારણ કે આ બેન્ચમાર્કનો ઉદ્દેશ્ય સર્વોચ્ચ સ્કોર માટેની સ્પર્ધા નહીં, પરંતુ from scratch પોતાના મોડેલે વૈશ્વિક મંચ પર સ્પર્ધા કરી શકે તેવા સ્તરે પહોંચ્યું છે કે નહીં તે ચકાસવાનો હતો.

GAIA લીડરબોર્ડ પર નામ નોંધાવવાનો અર્થ એ છે કે તૃતીય પક્ષના સ્વતંત્ર મૂલ્યાંકન દ્વારા પ્રમાણિત વિશ્વસનીયતા પ્રાપ્ત થઈ છે. આ રોકાણ મેળવવા, વિદેશી વિસ્તરણ અને B2B વેચાણના દરેક તબક્કે ઉપયોગ કરી શકાય તેવો વસ્તુલક્ષી આધાર બને છે.

CLEVIના એક પ્રતિનિધિએ જણાવ્યું, “સત્તાવાર રીતે ખોટા 63 જવાબોમાંથી નોંધપાત્ર સંખ્યા આઉટપુટ ફોર્મેટમાં અસંગતતા, દૃશ્ય સામગ્રીના અર્થઘટનની ભૂલો અને માહિતી ગુમ થવાને કારણે જવાબ ન આપી શકાય તેવા પ્રશ્નોમાંથી ઉદ્ભવી હતી. આ તાર્કિક અનુમાનની મૂળભૂત મર્યાદા કરતાં પોસ્ટ-પ્રોસેસિંગની ચોકસાઈ અને બાહ્ય માહિતીની ઉપલબ્ધતાની સમસ્યા છે. પોતાનું મોડેલ હોવાથી CLEVI તેમાં પોતે સુધારો કરી શકે છે. આ જ from scratch પોતાના મોડેલનો માળખાકીય લાભ છે. CLEVIની આ સિદ્ધિ કોરિયન AI ઉદ્યોગ સમક્ષ પ્રશ્ન મૂકે છે: ‘આપણે કેટલા સમય સુધી ‘ઉધાર લીધેલા મગજ’ પર નિર્ભર રહીશું?’ CLEVIએ from scratchનો વધુ મુશ્કેલ માર્ગ પસંદ કર્યો છે અને વૈશ્વિક મંચ પર તેનો જવાબ સાબિત કરવા માગે છે.”

ન્યૂઝરૂમ પર પાછા જાઓ
CLEVI

ભાષા અને પ્રદેશ

મશીન-અનુવાદિત ભાષાઓને ચિહ્નિત કરવામાં આવી છે. ઉપલબ્ધતા પ્રકાશિત સાઇટ બંડલ અનુસાર છે.

136 ભાષાઓ

ભલામણ કરેલ

1

પૂર્વીય એશિયા

7

દક્ષિણપૂર્વ એશિયા

11

દક્ષિણ એશિયા

18

મધ્ય એશિયા

5

મધ્ય પૂર્વ અને કાકેશસ

10

પશ્ચિમી યુરોપ અને દક્ષિણ યુરોપ

16

યુનાઇટેડ કિંગડમ અને આયર્લેન્ડ

4

ઉત્તરીય યુરોપ

10

મધ્ય યુરોપ અને બાલ્કન

14

પૂર્વીય યુરોપ

5

પૂર્વીય આફ્રિકા

8

પશ્ચિમી આફ્રિકા અને મધ્ય આફ્રિકા

9

સધર્ન આફ્રિકા

8

અમેરિકા

5

ઓશનિયા

5
AI સ્ટાર્ટઅપ CLEVI, GAIAના ટોચના 2.5%માં પ્રવેશ્યું… પ્રમાણિત વિશ્વસનીયતા દર્શાવી — CLEVI