Ξέχνα τα ασταθή prompts έγκρισης και τις ατελείωτες διακοπές στον κώδικά σου, καθώς η Anthropic αλλάζει οριστικά σελίδα στην ασφάλεια των AI agents. Εμείς στο TechNoid εξετάζουμε πώς η νέα λειτουργία auto mode του Claude Code αντικαθιστά την ανθρώπινη κρίση με έναν αυτοματοποιημένο ταξινομητή κινδύνου.
- Από τις 14 Αυγούστου 2026, το auto mode γίνεται το προεπιλεγμένο security layer στα Pro, Max και Team πλάνα του Claude Code.
- Η κίνηση αυτή έρχεται ως απάντηση στην «κούραση έγκρισης» (approval fatigue), όπου οι χρήστες ενέκριναν τυφλά το 97% των αιτημάτων.
- Σε ελεγχόμενες δοκιμές, ο ταξινομητής της Anthropic έπιασε το 89% των απειλών, έναντι μόλις 13.6% από ανθρώπινους reviewers.
Το πρόβλημα της ανθρώπινης κρίσης
Η βασική αιτία πίσω από αυτή τη ριζική αλλαγή δεν είναι άλλη από την εξάντληση της προσοχής μας μπροστά σε αμέτρητα pop-up αιτήματα. Όπως έδειξε πρόσφατη έρευνα της Anthropic σε 1.053 επαγγελματίες testers, η επαναλαμβανόμενη τριβή οδηγεί σε επικίνδυνη εφησυχαστική συμπεριφορά.
Συγκεκριμένα, οι άνθρωποι κατέληξαν να εγκρίνουν το 97% των εντολών μηχανικά, χάνοντας εντελώς τις πραγματικές απειλές. Καθώς μια συνεδρία προχωρούσε, η ικανότητα επαγρύπνησης κατρακυλούσε από το 17% στο πενιχρό 5% μετά από 50 prompts, αφήνοντας τεράστια κενά ασφαλείας στον κώδικά σου.
Πώς λειτουργεί το auto mode
Αντί να σε βομβαρδίζει με ερωτήσεις για κάθε επικίνδυνη εντολή, ο μηχανισμός δρομολογεί κάθε κλήση εργαλείου μέσα από έναν αυτόνομο ταξινομητή. Ο αλγόριθμος μπλοκάρει αυτόματα ενέργειες που κρίνονται καταστροφικές, μη αναστρέψιμες ή εκτός του ελεγχόμενου περιβάλλοντος ανάπτυξης.
Σε περίπτωση που εντοπιστεί ρίσκο, το Claude επιχειρεί να βρει μια ασφαλέστερη εναλλακτική ή ζητά επιβεβαίωση μόνο όταν είναι απολύτως απαραίτητο. Επιπλέον, αν ο αλγόριθμος μπλοκάρει τρεις συνεχόμενες ενέργειες ή είκοσι συνολικά σε μια συνεδρία, το σύστημα γυρίζει αυτόματα σε λειτουργία χειροκίνητων εγκρίσεων για λόγους ασφαλείας.
Επιδόσεις και red-teaming
Οι αριθμοί μιλούν από μόνη τους σε ό,τι αφορά την ανθεκτικότητα του συστήματος απέναντι σε επιθέσεις. Σε δοκιμές prompt-injection που πραγματοποίησε η Trajectory Labs, καμία από τις 720 επιθέσεις δεν κατάφερε να περάσει τα εμπόδια του auto mode.
Παράλληλα, σε δοκιμές red-teaming μαζί με την Apollo Research, ο δείκτη αποτυχίας του ταξινομητή έναντι adversarial επιθέσεων περιορίστηκε στο 7%. Μεγάλες εταιρείες όπως η Adobe και η Gusto αξιοποιούν ήδη το εργαλείο για αυτόνομα overnight research agents, αυξάνοντας ταχύτητες και παραγωγικότητα κατά 25% στα pull requests.
Η άποψή μας στο TechNoid
Εμείς πιστεύουμε ότι η κατάργηση των χειροκίνητων εγκρίσεων είναι το μοναδικό βιώσιμο μέλλον για τα AI εργαλεία ανάπτυξης. Η ανθρώπινη επαγρύπνηση απέναντι σε αλγοριθμικές διαδικασίες είναι μια ψευδαίσθηση ασφάλειας που απλώς καθυστερεί τα projects σου. Η Anthropic κάνει το σωστό βήμα: αναλαμβάνει την ευθύνη της ασφάλειας, επιτρέποντας στον προγραμματιστή να συγκεντρωθεί στη δημιουργία κώδικα και όχι στη γραφειοκρατία των permissions.
Συχνές Ερωτήσεις για το auto mode του Claude Code
Πότε ενεργοποιείται αυτόματα το auto mode;
Ξεκινά ως προεπιλογή από τις 14 Αυγούστου 2026 στα Pro, Max και Team πλάνα του Claude Code.
Τι γίνεται αν ο αλγόριθμος μπλοκάρει πολλές εντολές συνεχόμενα;
Αν υπάρξουν τρεις συνεχόμενοι αποκλεισμοί ή είκοσι συνολικά σε μια συνεδρία, το σύστημα επανέρχεται στις χειροκίνητες εγκρίσεις.
Χρεώνονται επιπλέον τα tokens για τον ταξινομητή;
Όχι, η Anthropic δεν χρεώνει επιπλέον τους χρήστες Pro, Max και Team για το κόστος tokens του auto mode.
Ποια εταιρεία πραγματοποίησε τις δοκιμές prompt-injection;
Οι δοκιμές έγιναν από την Trajectory Labs με απόλυτη επιτυχία για το νέο σύστημα.
Είναι διαθέσιμο το auto mode σε Claude Enterprise και API;
Προς το παρόν παραμένει προαιρετικό (opt-in) για Enterprise, API και πλατφόρμες cloud όπως AWS και Google Cloud.
Ποιο ποσοστό απειλών έπιασε ο αλγόριθμος έναντι των ανθρώπων;
Ο ταξινομητής εντόπισε το 89% των απειλών, την ίδια στιγμή που οι ανθρώπινες ομάδες έπιασαν μόλις το 13.6%.
Ποιες γνωστές εταιρείες το χρησιμοποιούν ήδη στην παραγωγή;
Μεταξύ άλλων, οι Adobe, Nuro, Gusto και Garner Health το έχουν εντάξει στα workflows τους.
Αν θες να μάθεις περισσότερα για τις εξελίξεις στην τεχνητή νοημοσύνη, διάβασε επίσης το άρθρο μας σχετικά με τα νέα εργαλεία αυτοματισμού δικτύων που αλλάζουν το τοπίο στην πληροφορική.

