GAIA ਸਕੋਰ ਦਾ ਅਰਥ — AI ਏਜੰਟ ਕਿੰਨਾ ਵਿਕਸਿਤ ਹੋਇਆ ਹੈ
ਜਦੋਂ GAIA ਬੈਂਚਮਾਰਕ ਪਹਿਲੀ ਵਾਰ ਜਾਰੀ ਕੀਤਾ ਗਿਆ ਸੀ, ਉਸ ਸਮੇਂ ਦੇ ਸਭ ਤੋਂ ਉੱਨਤ ਮਾਡਲ GPT-4 ਨੇ ਵੀ ਲਗਭਗ 30% ਦਾ ਸਕੋਰ ਹੀ ਹਾਸਲ ਕੀਤਾ ਸੀ। ਸਧਾਰਣ ਸਵਾਲ-ਜਵਾਬ ਤੋਂ ਇਲਾਵਾ ਜਟਿਲ ਤਰਕ, ਟੂਲਾਂ ਦੀ ਵਰਤੋਂ ਅਤੇ ਕਈ ਪੜਾਵਾਂ ਵਾਲੀ ਸਮੱਸਿਆ ਹੱਲ ਕਰਨ ਦੀ ਲੋੜ ਵਾਲੇ GAIA ਦੀ ਪ੍ਰਕਿਰਤੀ ਨੂੰ ਦੇਖਦੇ ਹੋਏ, ਇਸਦਾ ਅਰਥ ਸੀ ਕਿ ਉਸ ਸਮੇਂ AI ਦੀ “ਸੋਚਣ ਅਤੇ ਕਾਰਵਾਈ ਕਰਨ ਦੀ ਸਮਰੱਥਾ” ਹਾਲੇ ਸ਼ੁਰੂਆਤੀ ਪੜਾਅ ਵਿੱਚ ਸੀ।
ਪਰ ਹੁਣ, ਸਿਖਰਲੇ ਏਜੰਟ 92.36% ਤੱਕ ਪਹੁੰਚ ਗਏ ਹਨ।
ਇਹ ਬਦਲਾਅ ਸਿਰਫ਼ ਕਾਰਗੁਜ਼ਾਰੀ ਵਿੱਚ ਸੁਧਾਰ ਨਹੀਂ ਹੈ। ਇਹ ਦਰਸਾਉਂਦਾ ਹੈ ਕਿ AI ਹੁਣ ਸਵਾਲਾਂ ਦੇ ਜਵਾਬ ਦੇਣ ਤੋਂ ਅੱਗੇ ਵਧ ਕੇ ਸਥਿਤੀ ਦੀ ਵਿਆਖਿਆ ਕਰਨ, ਲੋੜੀਂਦੇ ਟੂਲ ਚੁਣਨ ਅਤੇ ਕਈ ਪੜਾਵਾਂ ਦੀ ਖੁਦ ਯੋਜਨਾ ਬਣਾਕੇ ਉਨ੍ਹਾਂ ਨੂੰ ਲਾਗੂ ਕਰਨ ਵਾਲੇ ‘Agentic AI’ ਪੜਾਅ ਵਿੱਚ ਦਾਖਲ ਹੋ ਗਿਆ ਹੈ।
ਕੁਝ ਹੀ ਸਾਲਾਂ ਵਿੱਚ, AI “ਗਿਆਨ ਪੈਦਾ ਕਰਨ ਵਾਲੇ ਟੂਲ” ਤੋਂ “ਕੰਮ ਕਰਨ ਵਾਲੇ ਕਾਰਜਕਾਰੀ ਸਾਧਨ” ਵਿੱਚ ਵਿਕਸਿਤ ਹੋ ਗਿਆ ਹੈ।
📌 ਅਤੇ ਉਸ ਸਿਖਰਲੇ 2.5% ਵਿੱਚ CLEVI ਵੀ ਸ਼ਾਮਲ ਹੈ
ਇਸ ਵਿਸ਼ਵ ਪੱਧਰੀ ਮੁਕਾਬਲੇ ਦੇ ਮਾਹੌਲ ਵਿੱਚ, ਦੇਸ਼ ਵਿੱਚ ਤਿਆਰ ਕੀਤਾ ਗਿਆ CLEVI ਦਾ ਏਜੰਟ GAIA ਲੀਡਰਬੋਰਡ ਦੇ ਸਿਖਰਲੇ 2.5% ਵਿੱਚ ਦਰਜ ਹੋਇਆ ਹੈ। ਇਹ ਤਕਨੀਕੀ ਆਤਮਨਿਰਭਰਤਾ ਦਾ ਸਬੂਤ ਹੈ ਅਤੇ ਇਸ ਗੱਲ ਦੀ ਪੁਸ਼ਟੀ ਕਰਦਾ ਹੈ ਕਿ ਕੋਰੀਆ ਵਿੱਚ ਬਣਾਇਆ ਗਿਆ AI ਏਜੰਟ ਵਿਸ਼ਵ ਪੱਧਰੀ ਮਾਪਦੰਡਾਂ 'ਤੇ ਵੀ ਪ੍ਰਭਾਵਸ਼ਾਲੀ ਹੈ। ਇਸਦਾ ਮਹੱਤਵ ਸਿਰਫ਼ ਇੱਕ ਅੰਕੜੇ ਤੱਕ ਸੀਮਿਤ ਨਹੀਂ ਹੈ। ਇਸਦਾ ਅਰਥ ਹੈ ਕਿ ਇਹ ਤਕਨੀਕੀ ਸਮਰੱਥਾ ਕਿਸੇ ਖਾਸ ਡੈਮੋ ਮਾਹੌਲ ਵਿੱਚ ਨਹੀਂ, ਸਗੋਂ ਵਿਸ਼ਵ ਪੱਧਰ 'ਤੇ ਜਨਤਕ ਬੈਂਚਮਾਰਕ ਵਿੱਚ ਹਜ਼ਾਰਾਂ ਮਾਡਲਾਂ ਨਾਲ ਮੁਕਾਬਲੇ ਰਾਹੀਂ ਵਸਤੁਨਿਸ਼ਠ ਤੌਰ 'ਤੇ ਪ੍ਰਮਾਣਿਤ ਹੋਈ ਹੈ।
ਇਸ ਤੋਂ ਵੀ ਮਹੱਤਵਪੂਰਨ ਗੱਲ ਇਹ ਹੈ ਕਿ ਇਹ ਉਪਲਬਧੀ ਕਿਸੇ ਇੱਕ ਮਾਡਲ ਦਾ ਸੰਜੋਗਵਸ਼ ਨਤੀਜਾ ਨਹੀਂ, ਸਗੋਂ ਇਹ ਹੈ ਕਿ ਇੱਕੋ Agent Stack 'ਤੇ ਆਧਾਰਿਤ ਵੱਖ-ਵੱਖ ਡਿਜ਼ਾਈਨਾਂ ਵਾਲੇ ਏਜੰਟਾਂ ਨੇ ਵਾਰ-ਵਾਰ ਸਿਖਰਲੇ ਪੱਧਰ ਦੀ ਕਾਰਗੁਜ਼ਾਰੀ ਹਾਸਲ ਕੀਤੀ ਹੈ।
ਅਰਥਾਤ, CLEVI ਦੀ ਤਕਨੀਕ “ਇੱਕ ਵਾਰ ਮਿਲਿਆ ਚੰਗਾ ਨਤੀਜਾ” ਨਹੀਂ, ਸਗੋਂ ਦੁਹਰਾਈ ਜਾ ਸਕਣ ਵਾਲੀ ਢਾਂਚਾਗਤ ਮੁਕਾਬਲਾਤਮਕ ਸਮਰੱਥਾ ਹੈ ਅਤੇ ਵੱਖ-ਵੱਖ ਉਦਯੋਗਾਂ ਤੇ ਦ੍ਰਿਸ਼ਾਂ ਵਿੱਚ ਵਿਸਤਾਰਯੋਗ ਪਲੇਟਫਾਰਮ-ਪੱਧਰੀ ਯੋਗਤਾ ਹੈ।
ਤਾਂ ਫਿਰ ਇਹ ਸੂਚਕ ਕੀ ਦਰਸਾਉਂਦਾ ਹੈ?
ਉਪਭੋਗਤਾ ਦੇ ਨਜ਼ਰੀਏ ਤੋਂ AI ਨੂੰ ਅਪਣਾਉਣ ਵਿੱਚ ਸਭ ਤੋਂ ਵੱਡੀ ਰੁਕਾਵਟ ਇਹ ਸਵਾਲ ਹੈ: "ਕੀ ਇਸ 'ਤੇ ਸੱਚਮੁੱਚ ਭਰੋਸਾ ਕਰਕੇ ਕੰਮ ਸੌਂਪਿਆ ਜਾ ਸਕਦਾ ਹੈ?"
ਚਮਕਦਾਰ ਡੈਮੋ ਜਾਂ ਆਪਣੀ ਕੰਪਨੀ ਦੀਆਂ ਪੇਸ਼ਕਾਰੀ ਸਮੱਗਰੀਆਂ ਨਹੀਂ, ਸਗੋਂ ਗਲੋਬਲ ਜਨਤਕ ਲੀਡਰਬੋਰਡ ਵਰਗੇ ਤੀਜੇ ਪੱਖ ਦੇ ਮੰਚ 'ਤੇ ਵਾਰ-ਵਾਰ ਸਾਬਤ ਹੋਈ ਕਾਰਗੁਜ਼ਾਰੀ ਹੀ ਇਸ ਸਵਾਲ ਦਾ ਸਭ ਤੋਂ ਵਸਤੁਨਿਸ਼ਠ ਜਵਾਬ ਹੈ। ਖਾਸ ਤੌਰ 'ਤੇ, ਇਸ ਦੇ ਤਿੰਨ ਮਹੱਤਵਪੂਰਨ ਪੱਖ ਹਨ।
ਪਹਿਲਾ, ਲਾਗੂ ਕਰਨ ਦੇ ਜੋਖਮ ਵਿੱਚ ਕਮੀ
ਅਣਪ੍ਰਮਾਣਿਤ AI ਨੂੰ ਅੰਦਰੂਨੀ ਕੰਮਕਾਜ ਨਾਲ ਜੋੜਨਾ ਕਿਸੇ ਵੀ ਕੰਪਨੀ ਲਈ ਕਾਫ਼ੀ ਵੱਡਾ ਬੋਝ ਹੁੰਦਾ ਹੈ।
GAIA ਵਰਗੇ ਭਰੋਸੇਯੋਗ ਬੈਂਚਮਾਰਕਾਂ ਵਿੱਚ ਪ੍ਰਾਪਤ ਕੀਤੀ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਤਕਨਾਲੋਜੀ ਸਮੀਖਿਆ ਦੇ ਪੜਾਅ 'ਤੇ ਭਰੋਸੇ ਦੇ ਆਧਾਰ ਵਜੋਂ ਸਿੱਧੇ ਤੌਰ 'ਤੇ ਵਰਤਿਆ ਜਾ ਸਕਦਾ ਹੈ।
ਦੂਜਾ, ਜਟਿਲ ਕੰਮਾਂ ਦੇ ਆਟੋਮੇਸ਼ਨ ਨੂੰ ਹਕੀਕਤ ਬਣਾਉਣਾ
ਸਿਖਰਲੇ 2.5% ਵਿੱਚ ਹੋਣ ਦਾ ਅੰਕੜਾ ਸਿਰਫ਼ ਦੁਹਰਾਏ ਜਾਣ ਵਾਲੇ ਕੰਮਾਂ ਤੋਂ ਅੱਗੇ ਦੀ ਉਸ ਪੱਧਰ ਦੀ ਬੁੱਧੀਮੱਤਾ ਨੂੰ ਦਰਸਾਉਂਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ ਸੰਦਰਭ ਨੂੰ ਸਮਝਣਾ ਅਤੇ ਕਈ ਪੜਾਵਾਂ ਬਾਰੇ ਖੁਦ ਫ਼ੈਸਲਾ ਕਰਕੇ ਕੰਮ ਪੂਰਾ ਕਰਨਾ ਸ਼ਾਮਲ ਹੈ।
ਉਹ ਕੰਮਕਾਜ ਦੇ ਖੇਤਰ ਜਿਨ੍ਹਾਂ ਨੂੰ ਹੁਣ ਤੱਕ "AI ਨੂੰ ਸੌਂਪਣਾ ਮੁਸ਼ਕਲ" ਸਮਝਿਆ ਜਾਂਦਾ ਸੀ, ਹੁਣ ਅਸਲ ਆਟੋਮੇਸ਼ਨ ਦਾ ਹਿੱਸਾ ਬਣ ਸਕਦੇ ਹਨ।
ਤੀਜਾ, ਡਾਟਾ ਸੁਰੱਖਿਆ ਅਤੇ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਇਕੱਠੇ ਯਕੀਨੀ ਬਣਾਉਣਾ
ਆਪਣਾ Agent Stack ਢਾਂਚਾ ਇਹ ਦਰਸਾਉਂਦਾ ਹੈ ਕਿ ਡਾਟਾ ਦਾ ਪ੍ਰਵਾਹ ਬਾਹਰ ਨਹੀਂ ਜਾਂਦਾ।
ਉੱਚ-ਕਾਰਗੁਜ਼ਾਰੀ ਵਾਲੇ AI ਦੀ ਵਰਤੋਂ ਲਈ ਸੁਰੱਖਿਆ ਨਾਲ ਸਮਝੌਤਾ ਕਰਨ ਦੀ ਪੁਰਾਣੀ ਦੁਵਿਧਾ ਤੋਂ ਹੁਣ ਬਾਹਰ ਨਿਕਲਿਆ ਜਾ ਸਕਦਾ ਹੈ।
ਖਾਸ ਤੌਰ 'ਤੇ ਵਿੱਤ, ਸਿਹਤ ਸੰਭਾਲ ਅਤੇ ਕਾਨੂੰਨੀ ਸੇਵਾਵਾਂ ਵਰਗੇ ਉੱਚ ਡਾਟਾ-ਸੰਵੇਦਨਸ਼ੀਲਤਾ ਵਾਲੇ ਉਦਯੋਗਾਂ ਵਿੱਚ, ਇਹ ਢਾਂਚਾ ਇੱਕ ਨਿਰਣਾਇਕ ਅੰਤਰ ਪੈਦਾ ਕਰਦਾ ਹੈ।
ਇਸ ਢਾਂਚੇ ਨੂੰ ਦੁਹਰਾਉਣ ਦੀ ਸੰਭਾਵਨਾ ਪਹਿਲਾਂ ਹੀ ਸਾਬਤ ਹੋਣੀ ਸ਼ੁਰੂ ਹੋ ਗਈ ਹੈ।
ਅਤੇ ਇਸ ਢਾਂਚੇ 'ਤੇ ਬਣਨ ਵਾਲੇ ਹਰੇਕ ਏਜੰਟ ਦੀ ਕਾਰਗੁਜ਼ਾਰੀ ਆਖ਼ਿਰਕਾਰ ਮੈਦਾਨੀ ਪੱਧਰ 'ਤੇ ਅਸਲ ਬਦਲਾਅ ਵਿੱਚ ਬਦਲ ਜਾਵੇਗੀ।
"ਆਖ਼ਿਰਕਾਰ, ਤਕਨਾਲੋਜੀ ਦੀ ਪੂਰਨਤਾ ਮੈਦਾਨੀ ਪੱਧਰ 'ਤੇ ਮਿਲਣ ਵਾਲੇ 'ਭਰੋਸੇ' ਨਾਲ ਪੂਰੀ ਹੁੰਦੀ ਹੈ।"
CLEVI ਸਿਰਫ਼ ਉੱਚ-ਕਾਰਗੁਜ਼ਾਰੀ ਵਾਲਾ AI ਪ੍ਰਦਾਨ ਕਰਨ ਤੱਕ ਸੀਮਿਤ ਨਹੀਂ ਹੈ। ਕੰਪਨੀਆਂ ਸਾਹਮਣੇ ਮੌਜੂਦ ਸੁਰੱਖਿਆ ਦੀਆਂ ਰੁਕਾਵਟਾਂ ਨੂੰ ਦੂਰ ਕਰਨਾ ਅਤੇ ਜਟਿਲ ਵਪਾਰਕ ਕੰਮਾਂ ਨੂੰ ਅਸਲ ਵਿੱਚ ਪੂਰਾ ਕਰ ਸਕਣ ਵਾਲਾ 'ਕਾਰਜਨਵਿਅਨ-ਕੇਂਦ੍ਰਿਤ ਬੁਨਿਆਦੀ ਢਾਂਚਾ' ਤਿਆਰ ਕਰਨਾ ਹੀ ਸਾਡਾ ਮੂਲ ਉਦੇਸ਼ ਹੈ।
ਹੁਣ ਅਪਣਾਉਣ ਬਾਰੇ ਵਿਚਾਰ ਕਰਨ ਦੇ ਪੜਾਅ ਤੋਂ ਅੱਗੇ ਵਧੋ ਅਤੇ CLEVI ਦੇ ਨਾਲ ਇੱਕ ਸੁਰੱਖਿਅਤ ਤੇ ਸ਼ਕਤੀਸ਼ਾਲੀ AI ਕਾਰਜ-ਵਾਤਾਵਰਣ ਦੀ ਸ਼ੁਰੂਆਤ ਕਰੋ।
ਤੁਹਾਡੇ ਕੰਮ ਨੂੰ ਭਰੋਸੇ ਨਾਲ ਸੌਂਪਣ ਯੋਗ ਮਜ਼ਬੂਤ ਭਾਗੀਦਾਰ ਵਜੋਂ, ਅਸੀਂ ਤੁਹਾਡੇ ਕਾਰੋਬਾਰੀ ਮੈਦਾਨ ਵਿੱਚ ਅਸਲ ਨਵੀਨਤਾ ਨੂੰ ਇਕੱਠੇ ਸਿਰਜਾਂਗੇ।
