Noticias

Competitividade demostrada con datos: o axente de IA desenvolvido en Corea alcanza o 2,5 % superior en GAIA Bench

Cando se publicou por primeira vez o benchmark GAIA, mesmo GPT-4, que era un dos modelos máis avanzados da época, apenas acadaba unha puntuación de arredor do 30 %. Isto débese a que GAIA esixe razoamento complexo, uso de ferramentas e resolución de problemas en varias etapas, máis alá das simples preguntas e respostas; naquela altura, a IA aínda estaba nunha fase inicial no que respecta á capacidade de «pensar e executar»…

O significado da puntuación de GAIA: canto avanzaron os axentes de IA?

Cando se publicou por primeira vez o benchmark GAIA, mesmo GPT-4, que era un dos modelos máis avanzados da época, apenas acadaba unha puntuación de arredor do 30 %. Isto significa que, debido ás características de GAIA, que esixe razoamento complexo, uso de ferramentas e resolución de problemas en varias etapas, máis alá das simples preguntas e respostas, a IA aínda estaba nunha fase inicial no que respecta á capacidade de «pensar e executar».

Porén, na actualidade, os axentes máis destacados acadaron o 92,36 %.

Este cambio non é simplemente unha mellora do rendemento. É un indicador de que a IA superou a fase de responder preguntas e entrou na etapa da «Agentic AI», na que interpreta situacións, selecciona as ferramentas necesarias e planifica e executa por si mesma varios pasos.

En apenas uns anos, a IA evolucionou de ser unha «ferramenta de xeración de coñecemento» a converterse nun «axente executivo que realiza tarefas».

Imaxe principal

📌 E entre ese 2,5 % superior está CLEVI

Neste contexto de competencia global, o feito de que o axente de CLEVI, desenvolvido en Corea, figure no 2,5 % superior da táboa de clasificación de GAIA demostra a súa independencia tecnolóxica e constitúe un caso que proba que un axente de IA creado en Corea tamén pode competir segundo os estándares globais. Isto ten un significado que vai máis alá dunha simple cifra. Significa que se trata dunha capacidade tecnolóxica validada obxectivamente mediante a competencia con miles de modelos nun benchmark global aberto, e non nun contorno de demostración específico.

O máis importante é que este logro non é o resultado fortuíto dun único modelo, senón que axentes con deseños diferentes lograron de forma reiterada un rendemento destacado sobre o mesmo Agent Stack.

É dicir, a tecnoloxía de CLEVI non é un «resultado que saíu ben unha vez», senón unha vantaxe competitiva estrutural e reproducible, cunha capacidade a nivel de plataforma que pode ampliarse a diversas industrias e escenarios.

Imaxe principal

Entón, que significa este indicador?

Desde a perspectiva do usuario, a maior barreira para adoptar a IA é a pregunta: «Pódese confiar nela de verdade e encargarlle tarefas?»

O rendemento demostrado repetidamente no escenario de terceiros que é a táboa de clasificación pública global, e non en demostracións vistosas nin en materiais de presentación propios, é a resposta máis obxectiva a esa pregunta. En concreto, ten importancia en tres aspectos.

En primeiro lugar, redución do risco de adopción

Para unha empresa, conectar unha IA non validada cos procesos internos supón unha carga considerable.

O rendemento en probas de referencia de recoñecido prestixio, como GAIA, pode utilizarse directamente como base de confianza durante a fase de avaliación tecnolóxica.

En segundo lugar, facer realidade a automatización de tarefas complexas

A cifra do 2,5 % superior representa un nivel de intelixencia que vai máis alá das tarefas repetitivas simples: comprende o contexto, toma decisións de forma autónoma en varias etapas e completa o traballo.

As áreas de traballo que ata agora se consideraban «difíciles de confiar á IA» poden converterse en obxectivos reais de automatización.

En terceiro lugar, garantir simultaneamente a seguridade dos datos e o rendemento

A estrutura propia de Agent Stack significa que o fluxo de datos non sae ao exterior.

Permite superar o dilema existente de ter que comprometer a seguridade para utilizar unha IA de alto rendemento.

Esta estrutura supón unha diferenza decisiva, especialmente en sectores cunha elevada sensibilidade dos datos, como os servizos financeiros, a saúde e o ámbito xurídico.

A reproducibilidade da estrutura xa comezou a estar demostrada.

E o rendemento de cada axente construído sobre esa estrutura pronto se traducirá en cambios reais no traballo diario.

«En definitiva, o grao de perfección da tecnoloxía complétase coa “confianza” no lugar de traballo.»

CLEVI non se limita a ofrecer unha IA de alto rendemento. A nosa esencia consiste en construír unha «infraestrutura orientada á execución» que derrube as barreiras de seguridade ás que se enfrontan as empresas e permita completar realmente tarefas prácticas complexas.

Agora, deixe atrás a fase de considerar a adopción e comece, xunto con CLEVI, un contorno de traballo de IA seguro e potente.

Como un socio fiable ao que pode confiar o seu traballo, crearemos xuntos innovacións reais no seu contorno empresarial.

Volver á sala de prensa
CLEVI

Idioma e rexión

As linguas traducidas automaticamente están marcadas. A dispoñibilidade segue o paquete do sitio publicado.

136 idiomas

Recomendado

1

Asia Oriental

7

Sueste Asiático

11

Asia Meridional

18

Asia Central

5

Oriente Medio e o Cáucaso

10

Europa Occidental e Europa Meridional

16

Reino Unido e Irlanda

4

Europa Setentrional

10

Europa Central e os Balcáns

14

Europa do Leste

5

África Oriental

8

África Occidental e África Central

9

África Meridional

8

América

5

Oceanía

5
Competitividade demostrada con datos: o axente de IA desenvolvido en Corea alcanza o 2,5 % superior en GAIA Bench — CLEVI