Η κούρσα για την τεχνητή νοημοσύνη ξεπερνά πλέον τα όρια του τεχνολογικού ανταγωνισμού. Οι κορυφαίοι ερευνητές εγκαταλείπουν τα εργαστήρια προειδοποιώντας για ανεξέλεγκτη υπερνοημοσύνη. Οι εταιρείες θυσιάζουν τα πρωτόκολλα ασφαλείας για να επικρατήσουν στην αγορά. Το ρίσκο δεν αφορά απλώς επιχειρηματικά μερίδια, αλλά το ίδιο το μέλλον μας.
- Ο ερευνητής Jacob Coxon παραιτήθηκε από την Anthropic, καταγγέλλοντας επιθετική επιτάχυνση προς την αναδρομική αυτοβελτίωση μοντέλων.
- Στελέχη ασφαλείας υπολογίζουν την πιθανότητα ολικής καταστροφής (p(doom)) πάνω από 10% μέσα στην τρέχουσα δεκαετία.
- Η πίεση για κέρδη, Wall Street και IPO ακυρώνει τις παλαιότερες δεσμεύσεις για προληπτικό πάγωμα επικίνδυνων μοντέλων.
Αναδρομική αυτοβελτίωση: Ο μηχανισμός του Endgame
Η παραίτηση του Jacob Coxon, κορυφαίου ερευνητή pre-training, αποκαλύπτει τι συμβαίνει πίσω από τις κλειστές πόρτες της OpenAI και της Anthropic. Ο Coxon δεν μίλησε για απλά chatbots, αλλά για την αναδρομική αυτοβελτίωση (Recursive Self-Improvement).
Πρόκειται για το σημείο καμπής όπου ένας αλγόριθμος αποκτά την ικανότητα να αναλύει τον ίδιο του τον πηγαίο κώδικα, να εντοπίζει αδυναμίες και να εκπαιδεύει την επόμενη, ισχυρότερη έκδοσή του. Όταν αυτό συμβεί αυτόνομα, ο ανθρώπινος παράγοντας εξοστρακίζεται από τον κύκλο ανάπτυξης μέσα σε ελάχιστα υπολογιστικά λεπτά.
Στην πράξη, αν ένα μοντέλο καταστεί ικανό να λύνει προηγμένα μαθηματικά και να γράφει κώδικα ταχύτερα από εκατό διδάκτορες μηχανικούς ταυτόχρονα, καμία ομάδα επιτήρησης δεν μπορεί να αξιολογήσει τα κίνητρά του. Σύμφωνα με το ρεπορτάζ του AFP, οι ίδιοι οι μηχανικοί αποκαλούν αυτή την πορεία «ώρα μηδέν».
OpenAI εναντίον Anthropic: Το δίλημμα του φυλακισμένου
Η Anthropic ιδρύθηκε από πρώην στελέχη της OpenAI με βασικό καταστατικό στόχο τη συνετή και ηθική προσέγγιση της τεχνητής νοημοσύνης. Ωστόσο, η είσοδος ιδιωτικών κεφαλαίων και η προετοιμασία για δημόσια εγγραφή (IPO) άλλαξαν δραματικά τις προτεραιότητες.
Τον περασμένο Φεβρουάριο, η εταιρεία αφαίρεσε σιωπηρά τη δέσμευση για μονομερές «πάγωμα» των μοντέλων της σε περίπτωση ανεξέλεγκτου ρίσκου. Το επιχείρημα της διοίκησης είναι κλασικό δίλημμα θεωρίας παιγνίων: αν επιβραδύνουμε εμείς, θα μας προσπεράσει ο ανταγωνιστής χωρίς κανένα ηθικό φραγμό.
Στις δοκιμές μας με τα νεότερα LLMs, παρατηρούμε ότι τόσο το ChatGPT όσο και το Claude ωθούνται σε πρωτοφανή αυτονομία execution μέσω agentic workflows. Η πίεση των επενδυτών να παρουσιαστούν εργαλεία ικανά να αντικαταστήσουν θέσεις εργασίας υπερκεράζει κάθε πρωτόκολλο ευθυγράμμισης (AI Alignment).
| Παράμετρος Αξιολόγησης | OpenAI | Anthropic |
|---|---|---|
| Αρχική Αποστολή | Ασφαλής AGI για την ανθρωπότητα | Public Benefit Corporation με focus στην ασφάλεια |
| Ρήτρα Μονομερούς Παύσης | Ανύπαρκτη σε εμπορικό επίπεδο | Καταργήθηκε τον Φεβρουάριο |
| Εκτιμώμενο p(doom) Στελεχών | Διαφοροποιείται (5% – 20%) | > 10% (κατά Evan Hubinger) |
| Εμπορική Πίεση | Συμμαχία Microsoft / Μετοχική αναδιάρθρωση | Προετοιμασία IPO / Χρηματοδότηση Amazon & Google |
Πιθανότητα 10%: Τι σημαίνει στην πράξη
Ο Evan Hubinger, κορυφαίος ερευνητής ασφαλείας της Anthropic, επιβεβαίωσε δημόσια στο X ότι ο κίνδυνος αφανισμού της ανθρωπότητας ξεπερνά το 10% μέσα στη δεκαετία. Στη στατιστική ανάλυση κινδύνου, ένα ρίσκο 10% για υπαρξιακή καταστροφή ισοδυναμεί με ρωσική ρουλέτα.
Φαντάσου να επιβιβαζόσουν σε αεροπλάνο αν ο κατασκευαστής δήλωνε 10% πιθανότητα συντριβής. Κανένας εποπτικός φορέας στον πλανήτη δεν θα επέτρεπε την απογείωση, ωστόσο στον τομέα του AI software η χρηματοδότηση συνεχίζεται ανεμπόδιστη.
Το θεμελιώδες πρόβλημα είναι η απουσία εφαρμόσιμου σχεδίου υπακοής. Όπως παραδέχτηκε ο Hubinger, κανείς δεν γνωρίζει πώς θα επιβληθεί έλεγχος σε ένα ψηφιακό σύστημα του οποίου η νοημοσύνη θα υπερβαίνει τη συνολική ανθρώπινη γνωστική ισχύ.
Υποδομές data centers και ρυθμιστικό κενό
Ο περιορισμός αυτής της απειλής δεν μπορεί να βασίζεται στην καλή πίστη των CEOs. Απαιτεί φυσικό έλεγχο στις υποδομές: τα τεράστια data centers, τους επιταχυντές γραφικών της Nvidia και τα δίκτυα υπερυψηλής ταχύτητας που φιλοξενούν τα συμπλέγματα προ-εκπαίδευσης.
Στην Ευρώπη, το πλαίσιο του EU AI Act προσπαθεί να κατηγοριοποιήσει τα μοντέλα βάσει ρίσκου και υπολογιστικής ισχύος (FLOPs). Ωστόσο, η γραφειοκρατία των Βρυξελλών κινείται με ρυθμούς ετών, ενώ η εκπαίδευση μοντέλων επόμενης γενιάς διαρκεί λίγους μήνες σε συμπλέγματα χιλιάδων GPUs.
Αν δεν επιβληθούν διεθνείς κυρώσεις και αυστηρός έλεγχος των αλυσίδων εφοδιασμού hardware, οι ιδιωτικές εταιρείες στη Silicon Valley θα συνεχίσουν να λειτουργούν εκτός κρατικού ελέγχου. Η εμπειρία μας με παρόμοιες τεχνολογικές κρίσεις δείχνει πως η αυτορρύθμιση στις Big Tech είναι απλώς επικοινωνιακό πυροτέχνημα.
Για να κατανοήσεις το ψηφιακό οικοσύστημα, δες πώς διαμορφώνονται οι εξελίξεις σε επεξεργαστές και mobile chips που θα τροφοδοτήσουν τις τοπικές εκδόσεις αυτών των νευρωνικών δικτύων.
Η άποψή μας στο TechNoid
Η υποκρισία στον χώρο της τεχνητής νοημοσύνης έφτασε στο απόγειό της. Δεν ανεχόμαστε πλέον εταιρείες να εμφανίζονται ως σωτήρες της ανθρωπότητας ενώ ταυτόχρονα αφαιρούν δικλείδες ασφαλείας για να ικανοποιήσουν τους επενδυτές των venture capitals.
Ο Jacob Coxon έπραξε το αυτονόητο κρούοντας τον κώδωνα του κινδύνου πριν να είναι αργά. Η δήλωση στελέχους ασφαλείας ότι υπάρχει 10% κίνδυνος αφανισμού χωρίς να υπάρχει έτοιμο σχέδιο αντιμετώπισης αποτελεί απόδειξη επικίνδυνης ανευθυνότητας.
Αν οι κυβερνήσεις δεν επιβάλουν άμεσα υποχρεωτικά hardware-level φρένα στην προ-εκπαίδευση υπερμεγεθών μοντέλων, το κόστος δεν θα μετρηθεί σε χαμένα δολάρια στο χρηματιστήριο. Θα το πληρώσουμε όλοι μας.
Συχνές Ερωτήσεις για την Ασφάλεια της AI
Τι είναι η αναδρομική αυτοβελτίωση (Recursive Self-Improvement);
Είναι η διαδικασία κατά την οποία ένα μοντέλο AI επανασχεδιάζει και βελτιστοποιεί αυτόνομα τον κώδικά του, επιτυγχάνοντας εκθετική αύξηση νοημοσύνης χωρίς ανθρώπινη παρέμβαση.
Γιατί παραιτήθηκε ο Jacob Coxon από την Anthropic;
Παραιτήθηκε καταγγέλλοντας ότι τόσο η OpenAI όσο και η Anthropic τρέχουν ανεύθυνα προς την υπερνοημοσύνη χωρίς μέτρα προστασίας, ρισκάροντας την ασφάλεια της ανθρωπότητας.
Τι σημαίνει ο δείκτης p(doom) που αναφέρουν οι επιστήμονες;
Είναι η εκτιμώμενη πιθανότητα να οδηγήσει η ανάπτυξη της τεχνητής νοημοσύνης στην ολοκληρωτική καταστροφή ή εξαφάνιση του ανθρώπινου είδους.
Γιατί η Anthropic άλλαξε την πολιτική ασφαλείας της;
Κατήργησε τη δέσμευση μονομερούς παύσης υπό τον φόβο ότι ο ανταγωνισμός (κυρίως η OpenAI) θα κυριαρχούσε στην αγορά χωρίς κανένα περιορισμό.
Μπορεί το EU AI Act να αποτρέψει τέτοιους κινδύνους;
Μόνο μερικώς, καθώς η νομοθεσία εστιάζει στην εφαρμογή και όχι στον άμεσο έλεγχο της προ-εκπαίδευσης στα αμερικανικά data centers.

