الأخبار

قدرة تنافسية مثبتة بالبيانات — وكيل الذكاء الاصطناعي المحلي يحقق مكانة ضمن أعلى 2.5% في معيار GAIA

عندما نُشر معيار GAIA لأول مرة، لم يتمكن حتى GPT-4، الذي كان آنذاك من بين النماذج الأعلى مستوى، من تجاوز درجة تقارب 30% تقريبًا. ونظرًا إلى أن GAIA يتطلب، إلى جانب الإجابة عن الأسئلة البسيطة، استدلالًا معقدًا واستخدام الأدوات وحل المشكلات متعددة المراحل، فإن ذلك يعني أن الذكاء الاصطناعي في ذلك الوقت كان لا يزال في مرحلة مبكرة من حيث «القدرة على التفكير والتنفيذ» …

معنى درجة GAIA — إلى أي مدى تطورت وكلاء الذكاء الاصطناعي؟

عندما نُشر معيار GAIA لأول مرة، لم يتمكن حتى GPT-4، الذي كان آنذاك من بين النماذج الأعلى مستوى، من تجاوز درجة تقارب 30% تقريبًا. ونظرًا إلى أن GAIA يتطلب، إلى جانب الإجابة عن الأسئلة البسيطة، استدلالًا معقدًا واستخدام الأدوات وحل المشكلات متعددة المراحل، فإن ذلك يعني أن الذكاء الاصطناعي في ذلك الوقت كان لا يزال في مرحلة مبكرة من حيث «القدرة على التفكير والتنفيذ».

أما اليوم، فقد وصلت الوكلاء المتقدمة إلى 92.36%.

هذا التغيير ليس مجرد تحسن في الأداء. فهو مؤشر على أن الذكاء الاصطناعي تجاوز مرحلة الإجابة عن الأسئلة، ودخل الآن مرحلة «الذكاء الاصطناعي القائم على الوكلاء» (Agentic AI)، حيث يفسر الموقف ويختار الأدوات اللازمة ويخطط وينفذ عدة مراحل بنفسه.

خلال بضع سنوات فقط، تطور الذكاء الاصطناعي من «أداة لتوليد المعرفة» إلى «جهة تنفيذية تنجز المهام».

صورة المتن

📌 ومن بين أعلى 2.5% هناك أيضًا كليفي

في ظل بيئة المنافسة العالمية هذه، فإن إدراج وكيل كليفي المطوَّر محليًا ضمن أعلى 2.5% في لوحة متصدرّي GAIA يثبت الاستقلالية التقنية، ويُعد مثالًا يبرهن على أن وكيل الذكاء الاصطناعي المصنوع في كوريا قادر على المنافسة وفق المعايير العالمية أيضًا. ولهذا الأمر معنى يتجاوز مجرد رقم. فهو يعني أن هذه القدرة التقنية قد خضعت للتحقق الموضوعي من خلال منافسة آلاف النماذج في معيار عالمي متاح للعامة، وليس في بيئة تجريبية محددة فحسب.

والأهم من ذلك أن هذا الإنجاز ليس نتيجة عرضية لنموذج واحد، بل إن وكلاء ذوي تصاميم مختلفة حققوا أداءً متقدمًا بصورة متكررة ضمن Agent Stack نفسه.

بعبارة أخرى، لا تتمثل تقنية كليفي في «نتيجة جيدة تحققت مرة واحدة»، بل في قدرة تنافسية هيكلية قابلة لإعادة الإنتاج، وفي كفاءة على مستوى المنصة قابلة للتوسع لتشمل مختلف الصناعات والسيناريوهات.

صورة المتن

إذن، ماذا يعني هذا المؤشر؟

من منظور المستخدم، يتمثل أكبر عائق أمام اعتماد الذكاء الاصطناعي في السؤال: «هل يمكن حقًا الوثوق به وتوكيل المهام إليه؟»

الأداء الذي تم إثباته مرارًا على منصة طرف ثالث، وهي لوحة المتصدرين العالمية المفتوحة، وليس عبر عروض تجريبية مبهرجة أو مواد عرض خاصة بالشركة، هو الإجابة الأكثر موضوعية عن ذلك السؤال. وتكمن أهميته تحديدًا في ثلاثة جوانب.

أولًا، الحد من مخاطر التبنّي

إن ربط ذكاء اصطناعي غير مُتحقَّق منه بالمهام الداخلية يمثل عبئًا كبيرًا من منظور الشركات.

يمكن الاستفادة مباشرةً من الإنجازات المحققة في معايير مرجعية موثوقة مثل GAIA كأساس للثقة خلال مرحلة التقييم التقني.

ثانيًا، تحويل أتمتة المهام المعقدة إلى واقع

إن النسبة البالغة 2.5% تعني مستوى من الذكاء يتجاوز المهام التكرارية البسيطة، ويفهم السياق ويقرر بشكل مستقل عدة خطوات وينجزها.

يمكن أن تصبح مجالات العمل التي كان يُعتقد حتى الآن أنه «من الصعب إسنادها إلى الذكاء الاصطناعي» أهدافًا فعلية للأتمتة.

ثالثًا، تحقيق أمن البيانات والأداء في آنٍ واحد

تعني بنية Agent Stack الخاصة أن تدفق البيانات لا يخرج إلى خارج المؤسسة.

وبذلك يمكن التحرر من المعضلة القديمة التي كانت تفرض التنازل عن الأمان لاستخدام ذكاء اصطناعي عالي الأداء.

ولا سيما في القطاعات ذات الحساسية العالية للبيانات، مثل الخدمات المالية والرعاية الصحية والشؤون القانونية، تمثل هذه البنية ميزة فارقة حاسمة.

لقد بدأ بالفعل إثبات إمكانية إعادة إنتاج هذه البنية.

وستؤدي إنجازات كل وكيل تُبنى على هذه البنية قريبًا إلى تغييرات ملموسة في مواقع العمل.

"في نهاية المطاف، تكتمل جودة التقنية عبر «الثقة» في الميدان."

لا تقتصر كليفي على تقديم ذكاء اصطناعي عالي الأداء فحسب. يتمثل جوهرنا في بناء «بنية تحتية تنفيذية» تهدم جدار الأمان الذي تواجهه الشركات، وتُمكّنها فعليًا من إتمام الأعمال المعقدة.

حان الوقت الآن للتخلي عن مرحلة التفكير في التبنّي والبدء، مع كليفي، في بيئة عمل آمنة وقوية للذكاء الاصطناعي.

بصفتنا شريكًا موثوقًا يمكنكم إسناد أعمالكم إليه بثقة، سنعمل معكم على إحداث ابتكار ملموس في مواقع أعمالكم.

العودة إلى غرفة الأخبار
CLEVI

اللغة والمنطقة

تم وضع علامة على اللغات المترجمة آليًا. ويعتمد التوفر على حزمة الموقع المنشورة.

136 لغة

موصى به

1

شرق آسيا

7

جنوب شرق آسيا

11

جنوب آسيا

18

وسط آسيا

5

الشرق الأوسط والقوقاز

10

غرب أوروبا وجنوب أوروبا

16

المملكة المتحدة وأيرلندا

4

شمال أوروبا

10

أوروبا الوسطى والبلقان

14

شرق أوروبا

5

شرق أفريقيا

8

غرب أفريقيا ووسط أفريقيا

9

أفريقيا الجنوبية

8

الأمريكتان

5

أوقيانوسيا

5