Νέα

Η startup τεχνητής νοημοσύνης 클레비 εισέρχεται στο κορυφαίο 2,5% του GAIA… αποδεικνύοντας την επαληθευμένη αξιοπιστία της

Πηγή: Digital Times, δημοσιογράφος Gu Bon-gyu

Πηγή: Digital Times, δημοσιογράφος Gu Bon-gyu

Πλήρης παράθεση του άρθρου «Η startup τεχνητής νοημοσύνης 클레비 εισέρχεται στο κορυφαίο 2,5% του GAIA… αποδεικνύοντας την επαληθευμένη αξιοπιστία της»

Ημερομηνία δημοσίευσης 2026-04-08

Σύνδεσμος: https://n.news.naver.com/article/029/0003020511?sid=105

Η εγχώρια startup τεχνητής νοημοσύνης ‘클레비(Clevi)’ ανακοίνωσε ότι, έχοντας κατασκευάσει από το μηδέν το δικό της μοντέλο και τη δική της λύση agent, εισήλθε για πρώτη φορά στη Νότια Κορέα στο κορυφαίο 2,5% του benchmark GAIA, με βάση το σύνολο των 3.090 εγγεγραμμένων μοντέλων.

Σύμφωνα με την εξήγηση του κλάδου, το GAIA, το οποίο σχεδιάστηκε από τη Meta AI και λειτουργεί από το Hugging Face, δεν εξετάζει αν η AI είναι «καλή σε ένα μόνο πράγμα», αλλά αν «μπορεί να συνδυάζει πολλαπλές ικανότητες για να επιλύει πραγματικά προβλήματα». Πρέπει να βρίσκει πληροφορίες στον ιστό, να διαβάζει πίνακες σε PDF, να αναλύει εικόνες, να εκτελεί κώδικα για υπολογισμούς και να συνθέτει τα αποτελέσματα ώστε να δίνει μία τελική απάντηση. Με 301 μη δημοσιευμένα ερωτήματα, τρία επίπεδα δυσκολίας και την αρχή της μη δημοσιοποίησης των απαντήσεων, η δομή του καθιστά αδύνατα τόσο το overfitting όσο και την εξαπάτηση.

Για να επιτευχθεί υψηλή βαθμολογία σε αυτή την εξέταση, απαιτούνται δύο πράγματα. Η ικανότητα συλλογισμού του γλωσσικού μοντέλου που αποτελεί τη βάση και μια λύση agent που συνδέει το μοντέλο με εργαλεία του πραγματικού κόσμου, ώστε να εκτελεί αυτόνομα εργασίες. Όσο καλό κι αν είναι το μοντέλο, αν ο agent είναι αδύναμος, δεν μπορεί να επιλύσει το Level 3, ενώ όσο εξελιγμένος κι αν είναι ο agent, αν η ικανότητα συλλογισμού του μοντέλου είναι ανεπαρκής, οι λανθασμένες απαντήσεις διαδίδονται ήδη από τα ενδιάμεσα στάδια.

Παρατηρώντας την τρέχουσα δομή του πίνακα κατάταξης του GAIA, διακρίνεται ένα ενδιαφέρον μοτίβο. Οι περισσότεροι agents στις κορυφαίες θέσεις υιοθετούν τη στρατηγική «μείγματος πολλαπλών μοντέλων», συνδυάζοντας διάφορα μοντέλα μεγάλων τεχνολογικών εταιρειών, όπως τα GPT, Claude και Gemini. Πρόκειται για μια λογική προσέγγιση που συνδυάζει τα πλεονεκτήματα κάθε μοντέλου και προστατεύει από τη μείωση της βαθμολογίας λόγω απώλειας πληροφοριών και άλλων παραγόντων.

Αντίθετα, η 클레비 δεν προσχώρησε σε αυτή την τάση. Το cip-5.5-agent (agentic AI), που αναπτύχθηκε με τη μέθοδο from scratch, εκτελεί αυτόνομα τον σχεδιασμό, την εκτέλεση και την επαλήθευση σύνθετων εργασιών, ενώ το cip-5.5-mm (υψηλών επιδόσεων γενικής χρήσης πολυτροπικό μοντέλο) κατανοεί και συλλογίζεται πάνω σε διάφορες μορφές αρχείων, όπως ήχο, εικόνες και βίντεο. Και τα δύο μοντέλα αναπτύχθηκαν ανεξάρτητα στο εσωτερικό της 클레비 και δεν χρησιμοποιήθηκε καθόλου εξωτερικό LLM API.

Και συμμετείχε στο GAIA με 5 πράκτορες χρησιμοποιώντας αυτό το ιδιόκτητο stack μοντέλων, καταγράφοντας όλοι βαθμολογία άνω των 70. Από το υψηλότερο 79,07% έως το 70,76%, αποδείχθηκε η σταθερότητα ολόκληρου του stack και όχι η τύχη ενός μεμονωμένου αποτελέσματος.

Εικόνα κύριου κειμένου

Σύμφωνα με την εταιρεία, πίσω από την επίσημη βαθμολογία του 79,07% υπάρχει ένας ακόμη αριθμός. Σε εσωτερικό εκ των υστέρων έλεγχο της CLEVI, διαπιστώθηκε ότι σε σημαντικό αριθμό από τα 301 ερωτήματα είχαν χαθεί οι τεκμηριώσεις των σωστών απαντήσεων από τον δημόσια διαθέσιμο ιστό. Όταν η αξιολόγηση επαναλήφθηκε με βάση μόνο τα ερωτήματα για τα οποία η σωστή απάντηση εξακολουθεί να υπάρχει στον ιστό, το ποσοστό σωστών απαντήσεων της CLEVI ξεπέρασε το 98%. Πρόκειται για ποσοστό που έχει ήδη υπερβεί τον ανθρώπινο μέσο όρο (92%).

Βεβαίως, η επίσημη βαθμολογία θα μπορούσε να είχε αυξηθεί ακόμη περισσότερο με τη συνδυασμένη χρήση ισχυρών μοντέλων γενικού σκοπού άλλων εταιρειών. Ωστόσο, η CLEVI επέλεξε σκόπιμα να μην ακολουθήσει αυτή τη στρατηγική. Ο στόχος αυτού του benchmark δεν ήταν ο ανταγωνισμός για την υψηλότερη βαθμολογία, αλλά η επαλήθευση του κατά πόσο ένα ιδιόκτητο μοντέλο from scratch είχε φτάσει σε επίπεδο που να μπορεί να ανταγωνιστεί στην παγκόσμια σκηνή.

Το γεγονός ότι το όνομα εμφανίζεται στον πίνακα κατάταξης του GAIA έχει μεγάλη σημασία, καθώς αποδεικνύει ότι διαθέτει επαληθευμένη αξιοπιστία, η οποία αποδόθηκε μέσω ανεξάρτητης αξιολόγησης από τρίτο μέρος. Αποτελεί αντικειμενικό τεκμήριο που μπορεί να αξιοποιηθεί σε κάθε στάδιο, από την προσέλκυση επενδύσεων και τη διεθνή επέκταση έως τις B2B πωλήσεις.

Εκπρόσωπος της CLEVI δήλωσε: «Από τα 63 επίσημα λανθασμένα αποτελέσματα, σημαντικό μέρος προήλθε από ασυμφωνία στη μορφή εξόδου, σφάλματα στην ερμηνεία οπτικού υλικού και ερωτήματα στα οποία ήταν αδύνατο να δοθεί σωστή απάντηση λόγω απώλειας πληροφοριών. Πρόκειται περισσότερο για ζήτημα ακρίβειας στη μετα-επεξεργασία και διαθεσιμότητας εξωτερικών πληροφοριών παρά για θεμελιώδη περιορισμό της λογικής συλλογιστικής. Επειδή πρόκειται για ιδιόκτητο μοντέλο, η CLEVI μπορεί να το βελτιώσει η ίδια. Αυτό είναι ακριβώς το δομικό πλεονέκτημα ενός ιδιόκτητου μοντέλου from scratch. Το επίτευγμα της CLEVI θέτει στην κορεατική βιομηχανία AI το ερώτημα: “Για πόσο ακόμη θα εξαρτόμαστε από ‘δανεικούς εγκεφάλους’;” Η CLEVI επέλεξε τον πιο δύσκολο δρόμο του from scratch και θέλει να αποδείξει την απάντηση στην παγκόσμια σκηνή».

Επιστροφή στην αίθουσα Τύπου
CLEVI

Γλώσσα και περιοχή

Οι γλώσσες που μεταφράζονται από μηχανή επισημαίνονται. Η διαθεσιμότητα ακολουθεί το δημοσιευμένο πακέτο ιστοτόπου.

136 γλώσσες

Προτεινόμενο

1

Ανατολική Ασία

7

Νοτιοανατολική Ασία

11

Νότια Ασία

18

Κεντρική Ασία

5

Μέση Ανατολή και Καύκασος

10

Δυτική Ευρώπη και Νότια Ευρώπη

16

Ηνωμένο Βασίλειο και Ιρλανδία

4

Βόρεια Ευρώπη

10

Κεντρική Ευρώπη και Βαλκάνια

14

Ανατολική Ευρώπη

5

Ανατολική Αφρική

8

Δυτική Αφρική και Μέση Αφρική

9

Νότιος Αφρική

8

Αμερική

5

Ωκεανία

5