ସମ୍ବାଦ

ଡାଟା ଦ୍ୱାରା ପ୍ରମାଣିତ ପ୍ରତିସ୍ପର୍ଦ୍ଧୀତା— ଦେଶୀୟ AI ଏଜେଣ୍ଟ, GAIA ବେଞ୍ଚର ଶୀର୍ଷ 2.5% ହାସଲ

GAIA ବେଞ୍ଚମାର୍କ ପ୍ରଥମେ ପ୍ରକାଶିତ ହେବାବେଳେ, ସେତେବେଳର ସର୍ବୋଚ୍ଚ ସ୍ତରର ମଡେଲ୍ GPT-4 ମଧ୍ୟ ପ୍ରାୟ 30% ସ୍ତରର ସ୍କୋର କରିବାରେ ସୀମିତ ଥିଲା। ଏହାର ଅର୍ଥ ହେଉଛି, ସରଳ ପ୍ରଶ୍ନୋତ୍ତରକୁ ଅତିକ୍ରମ କରି ଜଟିଳ ଯୁକ୍ତି, ଟୁଲ୍ ବ୍ୟବହାର ଏବଂ ବହୁ-ପର୍ଯ୍ୟାୟ ସମସ୍ୟା ସମାଧାନ ଆବଶ୍ୟକ କରୁଥିବା GAIAର ବୈଶିଷ୍ଟ୍ୟ ଅନୁସାରେ, ସେତେବେଳେ AI “ଚିନ୍ତା କରିବା ଏବଂ କାର୍ଯ୍ୟ କରିବାର କ୍ଷମତା”ରେ ଏପର୍ଯ୍ୟନ୍ତ ପ୍ରାରମ୍ଭିକ ପର୍ଯ୍ୟାୟରେ ଥିଲା …

GAIA ସ୍କୋରର ଅର୍ଥ — AI ଏଜେଣ୍ଟ କେତେ ଉନ୍ନତ ହୋଇଛି

GAIA ବେଞ୍ଚମାର୍କ ପ୍ରଥମେ ପ୍ରକାଶିତ ହେବାବେଳେ, ସେତେବେଳର ସର୍ବୋଚ୍ଚ ସ୍ତରର ମଡେଲ୍ GPT-4 ମଧ୍ୟ ପ୍ରାୟ 30% ସ୍ତରର ସ୍କୋର କରିବାରେ ସୀମିତ ଥିଲା। ଏହାର ଅର୍ଥ ହେଉଛି, ସରଳ ପ୍ରଶ୍ନୋତ୍ତରକୁ ଅତିକ୍ରମ କରି ଜଟିଳ ଯୁକ୍ତି, ଟୁଲ୍ ବ୍ୟବହାର ଏବଂ ବହୁ-ପର୍ଯ୍ୟାୟ ସମସ୍ୟା ସମାଧାନ ଆବଶ୍ୟକ କରୁଥିବା GAIAର ବୈଶିଷ୍ଟ୍ୟ ଅନୁସାରେ, ସେତେବେଳେ AI “ଚିନ୍ତା କରିବା ଏବଂ କାର୍ଯ୍ୟ କରିବାର କ୍ଷମତା”ରେ ଏପର୍ଯ୍ୟନ୍ତ ପ୍ରାରମ୍ଭିକ ପର୍ଯ୍ୟାୟରେ ଥିଲା।

କିନ୍ତୁ ବର୍ତ୍ତମାନ, ଶୀର୍ଷସ୍ଥ ଏଜେଣ୍ଟମାନେ 92.36%ରେ ପହଞ୍ଚିଛନ୍ତି।

ଏହି ପରିବର୍ତ୍ତନ କେବଳ କାର୍ଯ୍ୟଦକ୍ଷତାର ଉନ୍ନତି ନୁହେଁ। ଏହା ଦର୍ଶାଏ ଯେ AI ବର୍ତ୍ତମାନ ପ୍ରଶ୍ନର ଉତ୍ତର ଦେବାର ସ୍ତରକୁ ଅତିକ୍ରମ କରି ପରିସ୍ଥିତିକୁ ବୁଝିବା, ଆବଶ୍ୟକ ଟୁଲ୍ ବାଛିବା ଏବଂ ଏକାଧିକ ପର୍ଯ୍ୟାୟକୁ ନିଜେ ଯୋଜନା କରି କାର୍ଯ୍ୟକାରୀ କରିବାର ‘Agentic AI’ ପର୍ଯ୍ୟାୟରେ ପ୍ରବେଶ କରିଛି।

ମାତ୍ର କିଛି ବର୍ଷ ମଧ୍ୟରେ, AI “ଜ୍ଞାନ ସୃଷ୍ଟି ଟୁଲ୍”ରୁ “କାର୍ଯ୍ୟ ସମ୍ପାଦନ କରୁଥିବା କାର୍ଯ୍ୟକାରୀ ସତ୍ତା”ରେ ପରିଣତ ହୋଇଛି।

ମୁଖ୍ୟ ଅଂଶର ଛବି

📌 ଏବଂ ସେହି ଶୀର୍ଷ 2.5% ମଧ୍ୟରେ CLEVI ରହିଛି

ଏହି ବିଶ୍ୱସ୍ତରୀୟ ପ୍ରତିସ୍ପର୍ଦ୍ଧୀ ପରିବେଶରେ, ଦେଶରେ ନିର୍ମିତ CLEVIର ଏଜେଣ୍ଟ GAIA ଲିଡରବୋର୍ଡର ଶୀର୍ଷ 2.5%ରେ ସ୍ଥାନ ପାଇବା ଏହାର ପ୍ରଯୁକ୍ତିଗତ ସ୍ୱାଧୀନତାକୁ ପ୍ରମାଣିତ କରିଛି ଏବଂ କୋରିଆରେ ନିର୍ମିତ AI ଏଜେଣ୍ଟ ବିଶ୍ୱସ୍ତରୀୟ ମାନଦଣ୍ଡରେ ମଧ୍ୟ ସଫଳ ହୋଇପାରେ ବୋଲି ପ୍ରମାଣ କରିଛି। ଏହାର ଅର୍ଥ କେବଳ ଏକ ସଂଖ୍ୟାଠାରୁ ଅଧିକ। ଏହାର ଅର୍ଥ ହେଉଛି, ଏକ ନିର୍ଦ୍ଦିଷ୍ଟ ଡେମୋ ପରିବେଶରେ ନୁହେଁ, ବରଂ ବିଶ୍ୱସ୍ତରୀୟ ସାର୍ବଜନୀନ ବେଞ୍ଚମାର୍କରେ ହଜାର ହଜାର ମଡେଲ୍ ସହିତ ପ୍ରତିସ୍ପର୍ଦ୍ଧା ମାଧ୍ୟମରେ ବସ୍ତୁନିଷ୍ଠ ଭାବେ ପ୍ରମାଣିତ ପ୍ରଯୁକ୍ତିଗତ କ୍ଷମତା।

ତାଠାରୁ ଅଧିକ ଗୁରୁତ୍ୱପୂର୍ଣ୍ଣ କଥା ହେଉଛି, ଏହି ସଫଳତା କୌଣସି ଏକକ ମଡେଲର ଆକସ୍ମିକ ଫଳ ନୁହେଁ; ବରଂ ସମାନ Agent Stack ଉପରେ ନିର୍ମିତ ଭିନ୍ନ ଡିଜାଇନର ଏଜେଣ୍ଟମାନେ ପୁନରାବୃତ୍ତିଭାବେ ଶୀର୍ଷସ୍ଥ କାର୍ଯ୍ୟଦକ୍ଷତା ହାସଲ କରିଛନ୍ତି।

ଅର୍ଥାତ୍, CLEVIର ପ୍ରଯୁକ୍ତି “ଥରେ ଭଲ ମିଳିଥିବା ଫଳାଫଳ” ନୁହେଁ, ବରଂ ପୁନରୁତ୍ପାଦନଯୋଗ୍ୟ ଗଠନାତ୍ମକ ପ୍ରତିସ୍ପର୍ଦ୍ଧୀତା ଏବଂ ବିଭିନ୍ନ ଶିଳ୍ପ ଓ ପରିସ୍ଥିତିରେ ବିସ୍ତାରଯୋଗ୍ୟ ପ୍ଲାଟଫର୍ମ-ସ୍ତରୀୟ କ୍ଷମତା।

ମୁଖ୍ୟ ଅଂଶର ଛବି

ତେବେ ଏହି ସୂଚକର ଅର୍ଥ କ’ଣ?

ବ୍ୟବହାରକାରୀଙ୍କ ଦୃଷ୍ଟିକୋଣରୁ AI ଗ୍ରହଣର ସବୁଠାରୁ ବଡ଼ ବାଧା ହେଉଛି, “ପ୍ରକୃତରେ ଏହାକୁ ବିଶ୍ୱାସ କରି ଦାୟିତ୍ୱ ଦିଆଯାଇପାରିବ କି?” ବୋଲିଥିବା ପ୍ରଶ୍ନ।

ଚମତ୍କାରୀ ଡେମୋ କିମ୍ବା ନିଜସ୍ୱ ପ୍ରସ୍ତୁତି ସାମଗ୍ରୀ ନୁହେଁ, ବରଂ ବିଶ୍ୱସ୍ତରୀୟ ସାର୍ବଜନୀନ ଲିଡରବୋର୍ଡ ଭଳି ଏକ ତୃତୀୟ ପକ୍ଷର ମଞ୍ଚରେ ପୁନଃପୁନି ପ୍ରମାଣିତ ହୋଇଥିବା କାର୍ଯ୍ୟଦକ୍ଷତା ହିଁ ସେହି ପ୍ରଶ୍ନର ସବୁଠାରୁ ନିରପେକ୍ଷ ଉତ୍ତର। ନିର୍ଦ୍ଦିଷ୍ଟ ଭାବେ, ଏହାର ତିନୋଟି ପ୍ରମୁଖ ଦିଗରେ ଗୁରୁତ୍ୱ ରହିଛି।

ପ୍ରଥମ, ଗ୍ରହଣ କରିବାର ଝୁମ୍ପ ହ୍ରାସ

ପ୍ରମାଣିତ ହୋଇନଥିବା AIକୁ ଆଭ୍ୟନ୍ତରୀଣ କାର୍ଯ୍ୟ ସହିତ ସଂଯୋଗ କରିବା ଏକ କମ୍ପାନୀ ପାଇଁ ଉଲ୍ଲେଖନୀୟ ଭାର।

GAIA ପରି ବିଶ୍ୱସନୀୟ ବେଞ୍ଚମାର୍କରେ ହାସଲ କରାଯାଇଥିବା ସଫଳତାକୁ ପ୍ରଯୁକ୍ତି ସମୀକ୍ଷା ପର୍ଯ୍ୟାୟରେ ବିଶ୍ୱାସର ଆଧାର ଭାବେ ସିଧାସଳଖ ବ୍ୟବହାର କରାଯାଇପାରେ।

ଦ୍ୱିତୀୟ, ଜଟିଳ କାର୍ଯ୍ୟ ସ୍ୱୟଂଚାଳନର ବାସ୍ତବାୟନ

ଶୀର୍ଷ 2.5%ରେ ରହିବାର ଅର୍ଥ ହେଉଛି କେବଳ ପୁନରାବୃତ୍ତିମୂଳକ କାର୍ଯ୍ୟ ନୁହେଁ, ବରଂ ପ୍ରସଙ୍ଗ ବୁଝି ଏବଂ ଅନେକ ପର୍ଯ୍ୟାୟରେ ନିଜେ ନିଷ୍ପତ୍ତି ନେଇ ସେଗୁଡ଼ିକୁ ସମାପ୍ତ କରିପାରୁଥିବା ସ୍ତରର ବୁଦ୍ଧିମତ୍ତା।

ଏପର୍ଯ୍ୟନ୍ତ "AIକୁ ଦାୟିତ୍ୱ ଦେବା କଷ୍ଟକର" ବୋଲି ଭାବୁଥିବା କାର୍ଯ୍ୟକ୍ଷେତ୍ରଗୁଡ଼ିକ ବାସ୍ତବ ସ୍ୱୟଂଚାଳନର ଲକ୍ଷ୍ୟ ହୋଇପାରେ।

ତୃତୀୟ, ଡାଟା ସୁରକ୍ଷା ଏବଂ କାର୍ଯ୍ୟଦକ୍ଷତାର ଏକକାଳୀନ ସୁନିଶ୍ଚିତତା

ନିଜସ୍ୱ Agent Stack ଗଠନର ଅର୍ଥ ହେଉଛି ଡାଟା ପ୍ରବାହ ବାହାରକୁ ଯାଏ ନାହିଁ।

ଉଚ୍ଚ କାର୍ଯ୍ୟଦକ୍ଷତାର AI ବ୍ୟବହାର କରିବା ପାଇଁ ସୁରକ୍ଷା ସହିତ ସମଝୋତା କରିବାକୁ ପଡ଼ୁଥିବା ପୁରୁଣା ଦ୍ୱନ୍ଦ୍ୱରୁ ମୁକ୍ତ ହୋଇପାରିବେ।

ବିଶେଷକରି ଆର୍ଥିକ, ଚିକିତ୍ସା ଏବଂ ଆଇନ ପରି ଡାଟା ସମ୍ବେଦନଶୀଳତା ଅଧିକ ଥିବା ଶିଳ୍ପଗୁଡ଼ିକରେ, ଏହି ଗଠନ ଏକ ନିର୍ଣ୍ଣାୟକ ପାର୍ଥକ୍ୟ ସୃଷ୍ଟି କରେ।

ଏହି ଗଠନର ପୁନରୁତ୍ପାଦନୀୟତା ପ୍ରମାଣିତ ହେବା ଆରମ୍ଭ ହୋଇଛି।

ଏବଂ ସେହି ଗଠନ ଉପରେ ନିର୍ମିତ ପ୍ରତ୍ୟେକ ଏଜେଣ୍ଟର ସଫଳତା ଶୀଘ୍ର ହିଁ କାର୍ଯ୍ୟକ୍ଷେତ୍ରରେ ବାସ୍ତବ ପରିବର୍ତ୍ତନରେ ପରିଣତ ହେବ।

"ଶେଷ ପର୍ଯ୍ୟନ୍ତ, ପ୍ରଯୁକ୍ତିର ପରିପୂର୍ଣ୍ଣତା କାର୍ଯ୍ୟକ୍ଷେତ୍ରର 'ନିଶ୍ଚିତତା' ଦ୍ୱାରା ସମ୍ପୂର୍ଣ୍ଣ ହୁଏ।"

CLEVI କେବଳ ଉଚ୍ଚ କାର୍ଯ୍ୟଦକ୍ଷତାର AI ପ୍ରଦାନ କରିବାରେ ସୀମିତ ନୁହେଁ। କମ୍ପାନୀଗୁଡ଼ିକ ସମ୍ମୁଖୀନ ହେଉଥିବା ସୁରକ୍ଷାର ପ୍ରତିବନ୍ଧକକୁ ଦୂର କରି, ଜଟିଳ ବ୍ୟବହାରିକ କାର୍ଯ୍ୟଗୁଡ଼ିକୁ ବାସ୍ତବରେ ସମାପ୍ତ କରିପାରୁଥିବା 'କାର୍ଯ୍ୟନିଷ୍ପାଦନମୂଳକ ଭିତ୍ତିଭୂମି' ଗଠନ କରିବା ହେଉଛି ଆମର ମୂଳ ସ୍ୱରୂପ।

ଏବେ ଗ୍ରହଣ କରିବା ନେଇ ଚିନ୍ତା କରୁଥିବା ପର୍ଯ୍ୟାୟରୁ ଆଗକୁ ବଢ଼ି, CLEVI ସହିତ ଏକ ସୁରକ୍ଷିତ ଏବଂ ଶକ୍ତିଶାଳୀ AI କାର୍ଯ୍ୟ ପରିବେଶ ଆରମ୍ଭ କରନ୍ତୁ।

ଆପଣଙ୍କ କାମକୁ ନିର୍ଭରଯୋଗ୍ୟ ଭାବେ ଅର୍ପଣ କରିପାରିବା ଏକ ଦୃଢ଼ ସହଭାଗୀ ଭାବେ, ଆପଣଙ୍କ ବ୍ୟବସାୟିକ କାର୍ଯ୍ୟକ୍ଷେତ୍ରରେ ବାସ୍ତବ ନବୀନତା ଏକାଠି ସୃଷ୍ଟି କରିବୁ।

ସମ୍ବାଦକକ୍ଷକୁ ଫେରନ୍ତୁ
CLEVI

ଭାଷା ଏବଂ ଅଞ୍ଚଳ

ମେସିନ୍-ଅନୁବାଦିତ ଭାଷାଗୁଡ଼ିକୁ ଚିହ୍ନିତ କରାଯାଇଛି। ଉପଲବ୍ଧତା ପ୍ରକାଶିତ ସାଇଟ୍ ବଣ୍ଡଲ୍ ଅନୁସାରେ ରହିଛି।

136 ଭାଷା

ସୁପାରିଶ କରାଯାଇଛି

1

ପୂର୍ବ ଏସିଆ

7

ଦକ୍ଷିଣପୂର୍ବ ଏସିଆ

11

ଦକ୍ଷିଣ ଏସିଆ

18

ମଧ୍ୟ ଏସିଆ

5

ମଧ୍ୟ ପ୍ରାଚ୍ୟ ଏବଂ କାକେସସ

10

ପଶ୍ଚିମ ୟୁରୋପ୍ ଓ ଦକ୍ଷିଣ ୟୁରୋପ୍

16

ଯୁକ୍ତରାଜ୍ୟ ଓ ଆୟରଲ୍ୟାଣ୍ଡ

4

ଉତ୍ତର ୟୁରୋପ୍

10

ମଧ୍ୟ ୟୁରୋପ ଏବଂ ବାଲକାନ

14

ପୂର୍ବ ୟୁରୋପ୍

5

ପୂର୍ବ ଆଫ୍ରିକା

8

ପଶ୍ଚିମ ଆଫ୍ରିକା ଓ ମଧ୍ୟ ଆଫ୍ରିକା

9

ଦକ୍ଷିଣସ୍ଥ ଆଫ୍ରିକା

8

ଆମେରିକା

5

ଓସିନିଆ

5
ଡାଟା ଦ୍ୱାରା ପ୍ରମାଣିତ ପ୍ରତିସ୍ପର୍ଦ୍ଧୀତା— ଦେଶୀୟ AI ଏଜେଣ୍ଟ, GAIA ବେଞ୍ଚର ଶୀର୍ଷ 2.5% ହାସଲ — CLEVI