- Το Claude Code καθιστά το auto mode προεπιλογή από τις 14 Αυγούστου 2026 σε πλάνα Pro, Max και Team.
- Ένας classifier αναλαμβάνει την έγκριση ενεργειών, πετυχαίνοντας ποσοστό αποκλεισμού επικίνδυνων εντολών 89% έναντι 13,6% των ανθρώπων.
- Υπάρχουν κενά ασφαλείας, καθώς το pipeline απέτυχε στο 17% των πραγματικών δοκιμών και παραμένουν κίνδυνοι τύπου prompt injection.
Πώς λειτουργεί το auto mode
Η Anthropic αλλάζει ριζικά τον τρόπο που οι προγραμματιστές αλληλεπιδρούν με τα AI agents στα τερματικά τους. Στα πλάνα Pro, Max και Team, οι νέες συνεδρίες ξεκινούν αυτόματα χωρίς να περιμένουν χειροκίνητη έγκριση για κάθε εντολή shell ή αίτημα αρχείου, εκτός αν ο διαχειριστής ορίσει κάτι διαφορετικό. Η μετάβαση αυτή στηρίζεται σε έναν εξειδικευμένο μηχανισμό δύο επιπέδων που τρέχει στο Sonnet 4.6.
Στο πρώτο επίπεδο, ένας έλεγχος στον server σαρώνει το περιεχόμενο που επιστρέφουν τα εξωτερικά εργαλεία για κρυφές οδηγίες τύπου prompt injection. Στο δεύτερο επίπεδο, ο classifier εξετάζει το ιστορικό της συνομιλίας και αξιολογεί τις προτεινόμενες ενέργειες πριν αυτές εκτελεστούν στο σύστημά σου. Ο classifier βλέπει τα μηνύματα και τις κλήσεις, όχι όμως το εσωτερικό σκεπτικό του Claude ή τα ακατέργαστα αποτελέσματα των εργαλείων.
Αν ο agent αποτύχει τρεις διαδοχικές φορές ή φτάσει τις είκοσι απορρίψεις στην ίδια συνεδρία, το σύστημα τον γυρίζει αναγκαστικά σε χειροκίνητη έγκριση. Στις περιπτώσεις headless εκτέλεσης χωρίς επιβλέποντα χρήστη, η συνεδρία τερματίζεται αμέσως για λόγους ασφαλείας, αποτρέποντας ανεξέλεγκτα loops εντολών.
Τα νούμερα και η πραγματικότητα
Τα δεδομένα που δημοσιοποίησε η εταιρεία δείχνουν γιατί πήρε αυτή την απόφαση. Σύμφωνα με τις μετρήσεις, οι χρήστες εγκρίνουν τυφλά το 97% των αιτημάτων αδειοδότησης που τους εμφανίζει το Claude Code, κάνοντας το παραδοσιακό prompt modal ουσιαστικά περιττό. Μέχρι τον Ιούνιο, το 25% των διαδραστικών συνεδριών έτρεχε ήδη σε λειτουργία πλήρους παράκαμψης αδειών.
Σε ελεγχόμενη μελέτη της Anthropic με 1.053 επαγγελματίες δοκιμαστές, οι άνθρωποι απέκλεισαν μόλις το 13,6% των επικίνδυνων εντολών που είχαν τοποθετηθεί σκόπιμα. Αντίθετα, το auto mode απέκλεισε το 89% των ίδιων απειλών. Στις δοκιμές που ανέθεσε η εταιρεία σε εξωτερικούς φορείς, όπως οι Trajectory Labs στις 17 Ιουλίου 2026, καμία από τις 720 απόπειρες επίθεσης δεν πέτυχε εναντίον των Claude Fable 5, Opus 5 ή Sonnet 5 σε auto mode.
Ωστόσο, στα επίσημα δεδομένα υπάρχει μια παραφωνία. Το παραγωγικό pipeline της εταιρείας απέτυχε να εντοπίσει το 17% από 52 πραγματικές περιπτώσεις όπου το Claude επιχείρησε να ενεργήσει πέρα από τα όρια που είχε θέσει ο χρήστης. Η ίδια η εταιρεία παραδέχεται ότι οι χρήστες που ελέγχουν σχολαστικά κάθε βήμα μπορεί τελικά να βρίσκονται σε καλύτερη μοίρα από το να εμπιστεύονται έναν αλγόριθμο που κάνει λάθη.
Οι κίνδυνοι και το prompt injection
Η αυτοματοποίηση φέρνει στην επιφάνεια κλασικά προβλήματα ασφάλειας δικτύων και κώδικα. Ο ερευνητής Simon Willison ανέδειξε ένα κρίσιμο σενάριο επίθεσης μέσω κακόβουλου πακέτου τρίτου κατασκευαστή. Αν ένα εξωτερικό πακέτο περιέχει κρυφές οδηγίες που διατάζουν τον agent να κατεβάσει εκτελέσιμα αρχεία, το auto mode μπορεί να το επιτρέψει εφόσον το πακέτο δηλώνεται στο manifest του repository.
«Δεν είμαι σίγουρος πώς οποιαδήποτε εκδοχή του auto mode θα μπορούσε να προστατεύσει από αυτό το είδος κακόβουλης ενέργειας», σημειώνει χαρακτηριστικά ο Willison. Όταν ο πράκτορας κινείται αυτόνομα μέσα σε ένα περιβάλλον development με πρόσβαση σε κλειδιά API και repositories, κάθε κενό στον classifier μεταφράζεται σε άμεσο κίνδυνο διαρροφής δεδομένων.
Γι’ αυτόν ακριβώς τον λόγο, τα πλάνα Enterprise και API εξαιρούνται προσωρινά από την προεπιλογή, δίνοντας στους διαχειριστές χρόνο να προσαρμόσουν τις πολιτικές ασφαλείας τους. Η Anthropic προτείνει ρητά να διατηρείς ενεργό τον ανθρώπινο έλεγχο όταν επεμβαίνεις σε κρίσιμες υποδομές παραγωγής.
Η άποψή μας στο TechNoid
Στο TechNoid πιστεύουμε ότι η κίνηση της Anthropic είναι μονόδρομος για την επιβίωση των coding agents, αλλά συνοδεύεται από υπερβολικό ρίσκο για τους ανυποψίαστους χρήστες. Η αλήθεια είναι πως οι προγραμματιστές είχαν καταντήσει να πατούν “Enter” μηχανικά σε κάθε αίτημα έγκρισης, καθιστώντας το προηγούμενο σύστημα ψευδαίσθηση ασφάλειας. Ο classifier είναι απείρως πιο γρήγορος, όμως το 17% αστοχίας σε πραγματικά σενάρια δεν είναι αμελητέο ποσοστό. Αν δουλεύεις σε εσωτερικά projects με ευαίσθητα δεδομένα, μην αφήσεις το auto mode ανοιχτό χωρίς αυστηρά όρια στο περιβάλλον εργασίας σου.
Συχνές Ερωτήσεις για το Auto Mode του Claude Code
Πότε ενεργοποιείται το auto mode στο Claude Code;
Από τις 14 Αυγούστου 2026, το auto mode γίνεται η προεπιλογή για νέες συνεδρίες στα πλάνα Pro, Max και Team.
Ποια πλάνα εξαιρούνται προσωρινά από την αλλαγή;
Τα πλάνα Enterprise και API παραμένουν σε καθεστώς opt-in μέχρι οι διαχειριστές να εξετάσουν τις νέες ρυθμίσεις ασφαλείας.
Πώς αποφασίζει ο classifier αν μια ενέργεια είναι ασφαλής;
Ένας μηχανισμός βασισμένος στο Sonnet 4.6 αναλύει το ιστορικό συνομιλίας και τις κλήσεις εργαλείων σε σχέση με τις οδηγίες σου.
Τι γίνεται αν ο classifier απορρίψει πολλές εντολές διαδοχικά;
Μετά από τρεις συνεχόμενες απορρίψεις ή είκοσι συνολικά στην ίδια συνεδρία, το Claude Code επιστρέφει στη χειροκ έγκριση.
Υπάρχουν κίνδυνοι ασφαλείας με τη νέα λειτουργία;
Ναι, ερευνητές όπως ο Simon Willison προειδοποιούν για κινδύνους από prompt injection μέσω κακόβουλων πακέτων τρίτων.
Χρεώνονται επιπλέον τα tokens που καταναλώνει ο classifier;
Όχι, η Anthropic σταμάτησε να χρεώνει τους χρήστες Pro, Max και Team για τα tokens του classifier από τις 7 Αυγούστου 2026.
Πώς μπορώ να προστατεύσω την υποδομή μου;
Η Anthropic συνιστά να διατηρείς χειροκίνητη επίβλεψη σε κρίσιμες αλλαγές κώδικα και σε περιβάλλοντα παραγωγής.

