Η Anthropic προηγείται, αλλά οι δεσμεύσεις ασφάλειας υποχωρούν καθώς ο ανταγωνισμός εντείνεται
Η τεχνητή νοημοσύνη προχωρά με ταχύτητα που πριν από λίγα χρόνια θα φαινόταν ακραία. Τα frontier models αποκτούν καλύτερες δυνατότητες στον προγραμματισμό, την κυβερνοασφάλεια, την επιστημονική έρευνα και την αυτόνομη εκτέλεση εργασιών. Όμως η πρόοδος στην ασφάλεια, τη διακυβέρνηση και τον έλεγχο αυτών των συστημάτων δεν φαίνεται να ακολουθεί με τον ίδιο ρυθμό.
Το AI Safety Index 2026 αποτυπώνει αυτή την απόσταση με ιδιαίτερα αρνητικές βαθμολογίες για ολόκληρη σχεδόν τη βιομηχανία. Καμία από τις εννέα μεγαλύτερες εταιρείες AI που αξιολογήθηκαν δεν κατάφερε να ξεπεράσει το C+, ενώ τρεις εταιρείες έλαβαν συνολικό βαθμό F.
Η Anthropic βρίσκεται στην πρώτη θέση με C+ και αριθμητικό σκορ 2,66. Ακολουθούν η OpenAI με C και 2,28, η Google DeepMind με C και 2,01 και η Meta με D+ και 1,32. Στη συνέχεια βρίσκονται η Z.ai με D- και 0,88 και η Alibaba Cloud με D- και 0,87. Στο χαμηλότερο επίπεδο βρίσκονται η xAI με 0,65, η DeepSeek με 0,47 και η Mistral με μόλις 0,33, όλες με συνολική βαθμολογία F.
Το αποτέλεσμα είναι ιδιαίτερα εντυπωσιακό επειδή αφορά εταιρείες που βρίσκονται στην αιχμή της παγκόσμιας ανάπτυξης της AI και διαθέτουν τεράστιους οικονομικούς και τεχνικούς πόρους. Το πρόβλημα δεν είναι πλέον η απουσία συζητήσεων γύρω από την ασφάλεια. Είναι η απόσταση ανάμεσα στις δεσμεύσεις, στα safety frameworks και στους πραγματικά δεσμευτικούς μηχανισμούς που θα μπορούσαν να επιβραδύνουν ή να σταματήσουν την ανάπτυξη ενός επικίνδυνου συστήματος.
Τι ακριβώς βαθμολογεί το AI Safety Index 2026
Το AI Safety Index 2026 δεν είναι benchmark για το ποιο chatbot απαντά πιο ασφαλώς σε μια επικίνδυνη ερώτηση. Πρόκειται για πολύ ευρύτερη αξιολόγηση των διαδικασιών με τις οποίες οι μεγαλύτερες εταιρείες αναπτύσσουν, ελέγχουν και διαθέτουν προηγμένα μοντέλα AI.
Η αξιολόγηση καλύπτει 37 διαφορετικούς δείκτες κατανεμημένους σε έξι βασικούς τομείς: Risk Assessment, Current Harms, Safety Frameworks, Existential Safety, Governance & Accountability και Information Sharing.
Εξετάζονται μεταξύ άλλων οι δοκιμές επικίνδυνων δυνατοτήτων, τα εξωτερικά safety evaluations, η προστασία των safeguards από fine-tuning, τα περιστατικά ασφαλείας, η ιδιωτικότητα, οι πολιτικές whistleblowing, η δημοσιοποίηση τεχνικών πληροφοριών, τα όρια επικινδυνότητας και οι διαδικασίες που ενεργοποιούνται όταν ένα μοντέλο πλησιάζει αυτά τα όρια.
Τα δεδομένα της καλοκαιρινής έκδοσης καλύπτουν εξελίξεις έως τις 3 Ιουνίου 2026. Αυτό είναι σημαντικό, καθώς μεταγενέστερες αλλαγές στις πολιτικές ή στα μοντέλα των εταιρειών δεν επηρεάζουν τη συγκεκριμένη βαθμολογία.
Η Anthropic πρώτη, αλλά πολύ μακριά από άριστα
Η πρώτη θέση της Anthropic δεν σημαίνει ότι η εταιρεία θεωρείται ιδιαίτερα ασφαλής με απόλυτους όρους. Το C+ είναι απλώς η καλύτερη επίδοση σε μια βιομηχανία όπου κανείς δεν πλησιάζει τις υψηλότερες βαθμολογίες.
Η Anthropic εμφανίζει τις καλύτερες επιδόσεις σε πέντε από τους έξι βασικούς τομείς. Ξεχωρίζει ιδιαίτερα στην ανταλλαγή πληροφοριών και τη διαφάνεια, όπου βαθμολογείται με B+, στη διακυβέρνηση με B, αλλά και στα safety frameworks και στα current harms με B-.
Ωστόσο, ακόμη και η Anthropic καταλήγει στο D+ στον τομέα Existential Safety. Η αντίθεση είναι χαρακτηριστική. Μια εταιρεία μπορεί να διαθέτει εξελιγμένες διαδικασίες αξιολόγησης, safety teams και εκτεταμένη τεχνική τεκμηρίωση και παρ’ όλα αυτά να μην έχει παρουσιάσει έναν πειστικό μηχανισμό για την αντιμετώπιση ενός μελλοντικού συστήματος που θα μπορούσε να ξεφύγει από τον ανθρώπινο έλεγχο.
Η αναθεώρηση της Responsible Scaling Policy μέσα στο 2026 βρίσκεται επίσης στο επίκεντρο της συζήτησης. Η νέα πολιτική επιχειρεί να χρησιμοποιήσει πιο ρεαλιστικές δεσμεύσεις σε ένα ιδιαίτερα ανταγωνιστικό περιβάλλον, όμως η αλλαγή δημιούργησε ανησυχίες ότι προηγούμενες, αυστηρότερες κόκκινες γραμμές έχουν χάσει μέρος της δεσμευτικής τους ισχύος.
OpenAI και Google DeepMind παραμένουν στο C
Η OpenAI συγκεντρώνει 2,28 και βαθμό C, υποχωρώντας από το C+ της προηγούμενης χειμερινής αξιολόγησης. Η εταιρεία εμφανίζεται ιδιαίτερα ισχυρή στο Risk Assessment, όπου λαμβάνει C+, χάρη στο εύρος των evaluations και στη συνεργασία με εξωτερικούς φορείς δοκιμών.
Παράλληλα, το Preparedness Framework διαχωρίζει κρίσιμες κατηγορίες κινδύνου όπως βιολογικές και χημικές δυνατότητες, κυβερνοασφάλεια και AI self-improvement. Η λογική είναι ότι όσο αυξάνονται οι δυνατότητες των μοντέλων τόσο ισχυρότερα safeguards πρέπει να εφαρμόζονται πριν από την ανάπτυξή τους.
Το μεγαλύτερο ερώτημα όμως παραμένει ποιος έχει την τελική εξουσία όταν εμφανιστεί σύγκρουση μεταξύ ενός safety threshold και της επιχειρηματικής ανάγκης για κυκλοφορία ενός μοντέλου. Χωρίς πραγματικά ανεξάρτητο έλεγχο, ακόμη και ένα λεπτομερές πλαίσιο μπορεί τελικά να εξαρτάται από αποφάσεις της ίδιας διοίκησης που έχει κίνητρο να συνεχίσει την ανάπτυξη.
Η Google DeepMind ακολουθεί με 2,01 και επίσης C. Το Frontier Safety Framework έχει επεκταθεί ώστε να καλύπτει περιοχές όπως CBRN, κυβερνοασφάλεια, harmful manipulation, machine learning R&D και misalignment. Η εταιρεία έχει επίσης δημιουργήσει capability levels, συνεχή testing και διαδικασίες για την εφαρμογή mitigations πριν από την ανάπτυξη προηγμένων συστημάτων.
Παρά τη σημαντική αυτή υποδομή, η Google DeepMind λαμβάνει μόλις D στην Existential Safety και C- στη Governance & Accountability.
Η Meta βελτιώνεται, η xAI καταρρέει
Μία από τις λίγες εμφανείς βελτιώσεις του δείκτη προέρχεται από τη Meta. Η εταιρεία ανεβαίνει από D σε D+ και από την έκτη στην τέταρτη θέση.
Η Meta έχει πλέον δημοσιεύσει πιο ολοκληρωμένο πλαίσιο για catastrophic AI risks και περιλαμβάνει σενάρια loss of control. Ωστόσο, οι αναθεωρήσεις του Advanced AI Scaling Framework έχουν επίσης προκαλέσει ερωτήματα. Σε κρίσιμα επίπεδα κινδύνου, η γλώσσα μετακινήθηκε από πιο απόλυτες επιλογές όπως διακοπή ανάπτυξης ή μη κυκλοφορία προς μοντέλα όπου η ανάπτυξη μπορεί να συνεχιστεί με mitigations.
Στην άλλη πλευρά βρίσκεται η xAI. Από D στην προηγούμενη αξιολόγηση πέφτει σε F και από την τέταρτη στην έβδομη θέση. Το συνολικό σκορ της είναι μόλις 0,65, με F στους Current Harms, Existential Safety και Governance & Accountability.
Το γεγονός ότι μια αμερικανική εταιρεία frontier AI βρίσκεται στην ίδια γενική κατηγορία αποτυχίας με την DeepSeek και τη Mistral δείχνει ότι οι χαμηλές βαθμολογίες δεν μπορούν να εξηγηθούν απλώς από διαφορετικά εθνικά ρυθμιστικά περιβάλλοντα.
Το πιο ανησυχητικό αποτέλεσμα είναι το Existential Safety
Ο πιο αδύναμος τομέας σε ολόκληρο το AI Safety Index 2026 είναι η Existential Safety.
Η Anthropic και η OpenAI λαμβάνουν D+, η Google DeepMind D και όλες οι υπόλοιπες εταιρείες F. Καμία δεν φτάνει ούτε στο C-.
Η κατηγορία αυτή αφορά ένα από τα δυσκολότερα ερωτήματα της σύγχρονης έρευνας AI: τι γίνεται εάν δημιουργηθεί ένα σύστημα αρκετά αυτόνομο, στρατηγικά ικανό ή ισχυρό ώστε τα σημερινά safeguards να μην επαρκούν;
Η interpretability, η παρακολούθηση του chain of thought, τα alignment techniques και η ανίχνευση ανεπιθύμητων συμπεριφορών αποτελούν σημαντικές κατευθύνσεις έρευνας. Δεν ισοδυναμούν όμως με εγγύηση ελέγχου. Η δυνατότητα εντοπισμού μιας προβληματικής συμπεριφοράς δεν σημαίνει απαραίτητα ότι υπάρχει και τεχνικός μηχανισμός που μπορεί να την αποτρέψει.
Αυτό γίνεται σημαντικότερο όσο τα μοντέλα αποκτούν δυνατότητες αυτόνομης έρευνας, cyber operations, software engineering και εκτέλεσης μακροχρόνιων agentic workflows.
Οι δεσμεύσεις για pause αρχίζουν να αποδυναμώνονται
Το πιο πολιτικά και στρατηγικά σημαντικό στοιχείο του AI Safety Index 2026 δεν είναι ίσως οι ίδιοι οι βαθμοί. Είναι η αλλαγή στη συμπεριφορά των μεγαλύτερων εταιρειών όταν οι δεσμεύσεις ασφάλειας συγκρούονται με τον ανταγωνισμό.
Anthropic, OpenAI, Google DeepMind και Meta έχουν μετακινηθεί από προηγούμενες πιο αυστηρές δεσμεύσεις για μονομερή παύση όταν προσεγγίζονται συγκεκριμένες κόκκινες γραμμές, προς περισσότερο υπό όρους μηχανισμούς.
Το πρόβλημα είναι δομικό. Μια εταιρεία μπορεί να θεωρεί ότι η παύση είναι η ασφαλέστερη επιλογή, αλλά ταυτόχρονα να πιστεύει ότι η μονομερής διακοπή θα παραχωρήσει το τεχνολογικό πλεονέκτημα σε έναν ανταγωνιστή που δεν ακολουθεί τους ίδιους κανόνες.
Έτσι δημιουργείται ένας μηχανισμός όπου όλοι μπορούν θεωρητικά να υποστηρίζουν αυστηρά πρότυπα ασφάλειας, αλλά κανείς δεν θέλει να είναι ο πρώτος που θα επιβραδύνει.
Αυτή είναι ίσως η σημαντικότερη προειδοποίηση που προκύπτει από τις φετινές βαθμολογίες. Το βασικό πρόβλημα της AI safety δεν είναι πλέον μόνο τεχνικό. Είναι πρόβλημα κινήτρων, εταιρικής διακυβέρνησης και διεθνούς ανταγωνισμού.
Τα safety frameworks υπάρχουν, αλλά πρέπει να αποκτήσουν πραγματικά «δόντια»
Η βιομηχανία έχει σημειώσει σαφή πρόοδο στη δημιουργία safety frameworks, evaluations, model cards και risk classifications. Το ερώτημα πλέον είναι κατά πόσο αυτά τα συστήματα μπορούν πραγματικά να σταματήσουν μια κυκλοφορία ή ένα training run όταν οι συνθήκες το απαιτούν.
Χωρίς μετρήσιμα thresholds, ανεξάρτητους ελέγχους, ξεκάθαρη κατανομή αρμοδιοτήτων και προκαθορισμένες συνέπειες όταν παραβιάζονται οι κόκκινες γραμμές, ένα safety framework κινδυνεύει να μετατραπεί περισσότερο σε μηχανισμό ενημέρωσης παρά σε μηχανισμό περιορισμού.
Το AI Safety Index 2026 δείχνει τελικά μια βιομηχανία που γίνεται ταχύτερα ισχυρή από όσο γίνεται θεσμικά ώριμη. Οι κορυφαίες εταιρείες έχουν σαφώς περισσότερα εργαλεία ασφάλειας από ό,τι πριν από δύο ή τρία χρόνια, όμως ταυτόχρονα αναπτύσσουν πολύ ισχυρότερα και περισσότερο αυτόνομα συστήματα.
Το γεγονός ότι η καλύτερη συνολική βαθμολογία παραμένει στο C+ και ότι ακόμη και οι τρεις ηγέτες καταλήγουν σε D ή D+ στην Existential Safety δείχνει πόσο μεγάλο παραμένει το κενό.
Καθώς η επόμενη γενιά μοντέλων θα αποκτά ακόμη μεγαλύτερη αυτονομία, το κρίσιμο ερώτημα δεν θα είναι μόνο ποια εταιρεία διαθέτει το καλύτερο safety framework. Θα είναι αν το framework αυτό εξακολουθεί να ισχύει όταν η εφαρμογή του σημαίνει ότι η εταιρεία πρέπει πραγματικά να σταματήσει.
Πηγές
- https://futureoflife.org/ai-safety-index-summer-2026/
- https://www.anthropic.com/news/responsible-scaling-policy-v3
- https://cdn.openai.com/pdf/18a02b5d-6b67-4cec-ab64-68cdfbddebcd/preparedness-framework-v2.pdf
- https://deepmind.google/frontier-safety/
- https://ai.meta.com/static-resource/Meta_Advanced-AI-Scaling-Framework-v2












