বাতৰি

AI ষ্টাৰ্টআপ ক্লেভি, GAIA-ৰ শীৰ্ষ 2.5%-ত প্ৰৱেশ… প্ৰমাণিত বিশ্বাসযোগ্যতা প্ৰদৰ্শন

উৎস: ডিজিটেলটাইমছৰ সাংবাদিক গুবন গিউ

উৎস: ডিজিটেলটাইমছৰ সাংবাদিক গুবন গিউ

“AI ষ্টাৰ্টআপ ক্লেভি, GAIA-ৰ শীৰ্ষ 2.5%-ত প্ৰৱেশ… প্ৰমাণিত বিশ্বাসযোগ্যতা প্ৰদৰ্শন” শীৰ্ষক প্ৰবন্ধৰ সম্পূৰ্ণ উদ্ধৃতি

প্ৰকাশৰ তাৰিখ 2026-04-08

লিংক : https://n.news.naver.com/article/029/0003020511?sid=105

দক্ষিণ কোৰিয়াৰ AI ষ্টাৰ্টআপ ‘ক্লেভি (Clevi)’-য়ে from scratch পদ্ধতিত নিৰ্মাণ কৰা নিজস্ব মডেল আৰু নিজস্ব এজেণ্ট সমাধান গঢ়ি তোলাৰ মাজতে, দক্ষিণ কোৰিয়াত প্ৰথমবাৰৰ বাবে GAIA বেঞ্চমাৰ্কত পঞ্জীয়নভুক্ত মুঠ 3,090টা মডেলৰ ভিতৰত শীৰ্ষ 2.5%-ত প্ৰৱেশ কৰা বুলি ঘোষণা কৰিছে।

উদ্যোগটোৰ ব্যাখ্যা অনুসৰি, মেটা AI-য়ে ডিজাইন কৰা আৰু হাগিং ফেচে পৰিচালনা কৰা GAIA-য়ে AI-ক ‘মাত্ৰ এটা কাম ভালদৰে কৰাৰ ক্ষমতা’ নহয়, বৰং ‘বিভিন্ন ক্ষমতা সংযুক্ত কৰি বাস্তৱ সমস্যাৰ সমাধান কৰাৰ ক্ষমতা’ৰ বিষয়ে সোধে। ৱেবত তথ্য বিচাৰি উলিয়াব লাগে, PDF-ৰ ভিতৰৰ তালিকা পঢ়িব লাগে, ছবি বিশ্লেষণ কৰিব লাগে, কোড চলাই গণনা কৰিব লাগে আৰু সেই ফলাফলসমূহ একত্ৰিত কৰি এটা শুদ্ধ উত্তৰ দিব লাগে। 301টা গোপনীয় প্ৰশ্ন, তিনিটা কঠিনতাৰ স্তৰ আৰু উত্তৰ প্ৰকাশ নকৰাৰ নীতিৰ বাবে এই গঠনটোত overfitting বা cheating কৰা অসম্ভৱ।

এই পৰীক্ষাত উচ্চ নম্বৰ লাভ কৰিবলৈ দুটা বস্তুৰ প্ৰয়োজন। প্ৰথমটো হৈছে ভিত্তি হিচাপে থকা ভাষা মডেলটোৰ যুক্তি প্ৰয়োগৰ ক্ষমতা, আৰু দ্বিতীয়টো হৈছে সেই মডেলক বাস্তৱ জগতৰ সঁজুলিসমূহৰ সৈতে সংযোগ কৰি স্বায়ত্তশাসিতভাৱে কাম সম্পন্ন কৰোৱা এজেণ্ট সমাধান। মডেল যিমানেই ভাল নহওক কিয়, এজেণ্ট দুৰ্বল হ’লে Level 3 সমাধান কৰিব নোৱাৰি; আৰু এজেণ্ট যিমানেই সুক্ষ্ম নহওক কিয়, মডেলটোৰ যুক্তি প্ৰয়োগৰ ক্ষমতা অপৰ্যাপ্ত হ’লে মধ্যৱৰ্তী স্তৰতে ভুল উত্তৰ বিয়পি পৰে।

GAIA লিডাৰব’ৰ্ডৰ বৰ্তমান গঠন লক্ষ্য কৰিলে এটা আকৰ্ষণীয় ধৰণ দেখা যায়। শীৰ্ষস্থানীয় এজেণ্টসমূহৰ অধিকাংশই GPT, Claude, Gemini আদি একাধিক big tech মডেল সংযুক্ত কৰা ‘multi-model mix’ কৌশল গ্ৰহণ কৰিছে। প্ৰতিটো মডেলৰ শক্তি সংযুক্ত কৰা আৰু তথ্য হেৰুওৱা আদিৰ ফলত হোৱা নম্বৰ হ্ৰাস ৰোধ কৰাৰ বাবে এইটো এটা যুক্তিসংগত পদ্ধতি।

ইয়াৰ বিপৰীতে ক্লেভি সেই শাৰীত যোগ দিয়া নাই। from scratch পদ্ধতিত বিকশিত cip-5.5-agent (agentic AI)-য়ে জটিল কামৰ পৰিকল্পনা, সম্পাদন আৰু যাচাই স্বায়ত্তশাসিতভাৱে সম্পন্ন কৰে, আৰু cip-5.5-mm (উচ্চ-ক্ষমতাসম্পন্ন সাধাৰণ-purpose multimodal)-য়ে অডিঅ’, ছবি, ভিডিঅ’ আদি বিভিন্ন ফাইল ফৰ্মেট বুজি যুক্তি প্ৰয়োগ কৰে। এই দুয়োটা মডেলেই ক্লেভিৰ ভিতৰত স্বতন্ত্ৰভাৱে বিকশিত কৰা হৈছে আৰু বাহ্যিক LLM API একেবাৰেই ব্যৱহাৰ কৰা হোৱা নাই।

আৰু এই নিজস্ব মডেল ষ্টেকৰ জৰিয়তে GAIA-ত ৫টা এজেণ্ট প্ৰতিযোগিতাত নামাই, সকলোৱে ৭০ৰ ওপৰৰ স্ক’ৰ লাভ কৰিলে। সৰ্বোচ্চ ৭৯.০৭%ৰ পৰা ৭০.৭৬%লৈ—এয়া কোনো একক ফলাফলৰ ভাগ্য নহয়, বৰঞ্চ সমগ্ৰ ষ্টেকটোৰ স্থিৰতা প্ৰমাণিত হোৱাৰ ফল।

মূল পাঠৰ ছবি

কোম্পানীটোৰ ব্যাখ্যা অনুসৰি, চৰকাৰী স্ক’ৰ ৭৯.০৭%ৰ আঁৰত আৰু এটা সংখ্যা আছে। ক্লেভিৰ আভ্যন্তৰীণ পৰৱৰ্তী পৰ্যালোচনাত দেখা গ’ল যে ৩০১টা প্ৰশ্নৰ ভিতৰত বহু প্ৰশ্নৰ সঠিক উত্তৰৰ প্ৰমাণ বৰ্তমান মুকলি ৱেবত আৰু উপলব্ধ নহয়। যিবোৰ প্ৰশ্নৰ সঠিক উত্তৰ এতিয়াও ৱেবত আছে, কেৱল সেইবোৰৰ ভিত্তিত পুনৰ মূল্যায়ন কৰোঁতে ক্লেভিৰ সঠিক উত্তৰৰ হাৰ ৯৮%তকৈ অধিক আছিল। এই সংখ্যা ইতিমধ্যে মানুহৰ গড় (৯২%)ক অতিক্ৰম কৰিছে।

অৱশ্যেই, আন কোম্পানীৰ শক্তিশালী সৰ্বমুখী মডেল মিহলাই ল’লে চৰকাৰী স্ক’ৰ আৰু অধিক বৃদ্ধি কৰিব পৰা গ’লহেঁতেন। কিন্তু ক্লেভিয়ে ইচ্ছাকৃতভাৱে সেই কৌশল গ্ৰহণ কৰা নাছিল। কাৰণ, এই বেঞ্চমাৰ্কৰ লক্ষ্য সৰ্বোচ্চ স্ক’ৰৰ প্ৰতিযোগিতা নহয়, বৰঞ্চ from scratch নিজস্ব মডেলে বিশ্ব মঞ্চত প্ৰতিযোগিতা কৰিব পৰা পৰ্যায়ত উপনীত হৈছে নে নাই, সেয়া পৰীক্ষা কৰাহে আছিল।

GAIA লিডাৰবৰ্ডত নাম উঠাৰ অৰ্থ হৈছে তৃতীয় পক্ষৰ স্বাধীন মূল্যায়নে প্ৰদান কৰা যাচাইকৃত বিশ্বাসযোগ্যতা লাভ কৰা। বিনিয়োগ সংগ্ৰহ, বিদেশত প্ৰৱেশ আৰু B2B বিক্ৰীৰ সকলো পৰ্যায়তে ব্যৱহাৰ কৰিব পৰা এয়া এক বস্তুনিষ্ঠ প্ৰমাণ।

ক্লেভিৰ এগৰাকী বিষয়াই কয়, “চৰকাৰীভাৱে ভুল হিচাপে গণ্য হোৱা ৬৩টা উত্তৰৰ ভিতৰত বহুতো আউটপুট ফৰ্মেটৰ অমিল, দৃশ্যমান সামগ্ৰী ব্যাখ্যাৰ ভুল আৰু তথ্য হেৰাই যোৱাৰ বাবে উত্তৰ দিব নোৱাৰা প্ৰশ্নৰ ফলত হৈছিল। এয়া যুক্তিসংগত অনুমানৰ মৌলিক সীমাবদ্ধতাতকৈ অধিক পৰৱৰ্তী-প্ৰক্ৰিয়াকৰণৰ নিখুঁততা আৰু বাহ্যিক তথ্যৰ উপলব্ধতাৰ সমস্যা। নিজস্ব মডেল হোৱাৰ বাবে ক্লেভিয়ে নিজেই ইয়াৰ উন্নতি সাধন কৰিব পাৰে। এয়াই from scratch নিজস্ব মডেলৰ গাঁথনিগত সুবিধা। ক্লেভিৰ এই সাফল্যই কোৰিয়াৰ AI উদ্যোগলৈ ‘আমি আৰু কিমান দিনলৈ “ধাৰ কৰা মগজু”ৰ ওপৰত নিৰ্ভৰ কৰি থাকিম?’—এই প্ৰশ্ন উত্থাপন কৰিছে। ক্লেভিয়ে from scratch নামৰ অধিক কঠিন পথটো বাছি লৈছে আৰু বিশ্ব মঞ্চত তাৰ উত্তৰ প্ৰমাণ কৰিব বিচাৰে,” তেওঁ জনায়।”

বাতৰি কক্ষলৈ উভতি যাওক
CLEVI

ভাষা আৰু অঞ্চল

যন্ত্ৰ-অনূদিত ভাষাসমূহ চিহ্নিত কৰা হৈছে। উপলব্ধতা প্ৰকাশিত ছাইট বাণ্ডল অনুসৰি।

১৩৬ ভাষা

পৰামৰ্শিত

1

প্ৰাচ্য এছিয়া

7

দক্ষিণ-পূব এছিয়া

11

দাক্ষিণাত্য এছিয়া

18

মধ্য এছিয়া

5

মধ্যপ্ৰাচ্য আৰু ককেছাছ

10

পাশ্চাত্য ইউৰোপ আৰু দাক্ষিণাত্য ইউৰোপ

16

সংযুক্ত ৰাজ্য আৰু আয়াৰলেণ্ড

4

উদীচ্য ইউৰোপ

10

মধ্য ইউৰোপ আৰু বাল্কান

14

প্ৰাচ্য ইউৰোপ

5

প্ৰাচ্য আফ্ৰিকা

8

পাশ্চাত্য আফ্ৰিকা আৰু মধ্য আফ্ৰিকা

9

দাক্ষিণাত্য আফ্ৰিকা

8

আমেৰিকাছ্

5

অ’চেনীয়া

5