Η τεχνητή νοημοσύνη αναδιαμορφώνει με καταιγιστικούς ρυθμούς τη σύγχρονη επιστημονική έρευνα. Τι συμβαίνει όμως όταν τα προηγμένα μοντέλα αγγίζουν επικίνδυνα βιολογικά μονοπάτια; Η Anthropic προχώρησε στον αποκλεισμό επιστημονικών λογαριασμών υπό τον φόβο ανάπτυξης βιολογικών απειλών. Η ισορροπία ανάμεσα στην ιατρική πρόοδο και την ασφάλεια δοκιμάζεται πλέον σκληρά στην πράξη.
- Η Anthropic τερμάτισε λογαριασμούς ερευνητών που συνδέονταν με στρατιωτικά ιδρύματα και πειράματα πάνω σε παθογόνους ιούς όπως ο chikungunya.
- Η φύση «διπλής χρήσης» της τεχνολογίας καθιστά δυσδιάκριτη τη διαφορά ανάμεσα στην παρασκευή εμβολίων και στη δημιουργία βιολογικών όπλων.
- Το πραγματικό πρόβλημα μετατοπίζεται πλέον στα τοπικά, ανοιχτά συστήματα όπου τα φίλτρα ασφαλείας μπορούν να παρακαμφθούν οριστικά.
Τεχνητή νοημοσύνη διπλής χρήσης: Ο μηχανισμός κινδύνου
Στη βιολογία, τα ίδια εργαλεία που σχεδιάζουν ένα σωτήριο αντίσωμα μπορούν να τροποποιήσουν έναν ιό ώστε να υπερνικά το ανθρώπινο ανοσοποιητικό σύστημα. Αυτός είναι ο ορισμός της τεχνολογίας «διπλής χρήσης» (dual-use). Όταν ένα γλωσσικό μοντέλο όπως το Claude αποκτά βαθιά κατανόηση πρωτεϊνικών δομών και γενετικής μηχανικής, ο κίνδυνος εκθετικοποιείται.
Όπως αποκάλυψαν οι New York Times, η ομάδα Threat Intelligence της Anthropic εντόπισε ερευνητή που ζητούσε βοήθεια για σύνταξη πρότασης χρηματοδότησης γύρω από τον επικίνδυνο ιό chikungunya. Το πρόβλημα δεν ήταν μόνο το παθογόνο, αλλά το γεγονός ότι η έρευνα συνδεόταν με στρατιωτικό ίδρυμα.
«Κανείς δεν δηλώνει ανοιχτά ότι θέλει να κατασκευάσει όπλο», παραδέχτηκε ο Jacob Klein, επικεφαλής Threat Intelligence της εταιρείας. Οι πλατφόρμες εφαρμόζουν πλέον συνεχή επιτήρηση σε πραγματικό χρόνο και σύνθετα μέτρα ασφαλείας στα LLM για να προλαμβάνουν τέτοια prompts.
Γεωπολιτική, κυβερνοπόλεμος και κρατικοί παράγοντες
Η βιολογική απειλή δεν αποτελεί μεμονωμένο περιστατικό. Στην ίδια έκθεση τεκμηριώνεται ότι κακόβουλοι δρώντες από την Κίνα και το Ιράν εκμεταλλεύτηκαν το Claude για την ψηφιακή παρακολούθηση πολιτικών αντιφρονούντων. Παράλληλα, ρωσικά κρατικά δίκτυα παρήγαγαν συστηματική προπαγάνδα, μεταμφιεσμένη σε ανεξάρτητο ρεπορτάζ.
Αν νομίζεις ότι οι γεωγραφικοί περιορισμοί (geo-blocking) προστατεύουν τις υποδομές, η πραγματικότητα είναι διαφορετική. Οι επιτιθέμενοι αξιοποιούν οικιακά proxy networks (residential VPNs) και κλεμμένα API credentials για να εμφανίζονται ως νόμιμοι χρήστες από την Ευρώπη ή τις ΗΠΑ. Στην πράξη, η ιχνηλάτηση αυτών των συνδέσεων απαιτεί προηγμένη ανάλυση συμπεριφοράς δικτύου.
Ακόμη πιο ανησυχητικό είναι το γεγονός ότι χρήστες από την Υεμένη, τη Ρωσία και την Κίνα προσπάθησαν να χρησιμοποιήσουν αλγορίθμους για τον σχεδιασμό εξαρτημάτων συμβατικών όπλων. Το σύστημα ασφαλείας αντέδρασε, αλλά το ψηφιακό αποτύπωμα των επιθέσεων παραμένει ενεργό.
Το παράδοξο των ανοιχτών μοντέλων
Εδώ βρίσκεται η λεπτομέρεια που αποσιωπούν οι περισσότερες αναλύσεις: Η Anthropic, η OpenAI και η Google μπορούν να κλείσουν τον διακόπτη ενός API ανά πάσα στιγμή. Τι συμβαίνει όμως όταν ένας κακόβουλος φορέας κατεβάσει τοπικά ένα μοντέλο ανοιχτών βαρών;
Στη δοκιμή αντίστοιχων τεχνολογιών γίνεται σαφές ότι η διαδικασία του “un-censoring” (μέσω τεχνικών όπως το abliteration) διαρκεί ελάχιστα λεπτά. Εφόσον αφαιρεθούν τα φίλτρα ευθυγράμμισης (RLHF), ένα ισχυρό σύστημα μπορεί να απαντήσει χωρίς κανέναν ηθικό περιορισμό. Τα σύγχρονα μοντέλα ανοιχτού κώδικα πλησιάζουν επικίνδυνα τις επιδόσεις των εμπορικών κολοσσών.
Ο Andrew Weber από το Council on Strategic Risks προτείνει αυστηρό έλεγχο ταυτότητας (vetting) των ερευνητών. Ωστόσο, αυτό εφαρμόζεται μόνο σε κλειστά cloud οικοσυστήματα. Όταν τα weights τρέχουν σε έναν τοπικό server με καταναλωτικές GPU, κανένας οργανισμός δεν μπορεί να επέμβει.
| Μοντέλο / Πλατφόρμα | Έλεγχος Prompt (Dual-Use) | Δυνατότητα Αποκλεισμού | Κίνδυνος Κατάχρησης |
|---|---|---|---|
| Anthropic (Claude API) | Αυστηρός (Real-time monitoring) | Άμεση ανάκληση API key | Χαμηλός προς Ελεγχόμενος |
| OpenAI (GPT-4o API) | Αυστηρός (Automated moderations) | Άμεση ανάκληση λογαριασμού | Χαμηλός |
| Open-Weights (Local host) | Ανύπαρκτος μετά από jailbreak | Τεχνικά αδύνατη | Εξαιρετικά Υψηλός |
Η άποψή μας στο TechNoid
Η κίνηση της Anthropic να δημοσιοποιήσει αυτά τα περιστατικά αποτελεί κίνηση ουσίας και όχι απλό PR. Ταυτόχρονα όμως αναδεικνύει μια υποκριτική πραγματικότητα της βιομηχανίας. Η απαγόρευση πρόσβασης μέσω cloud API μοιάζει με το να κλειδώνεις την μπροστινή πόρτα ενώ τα παράθυρα είναι ορθάνοιχτα.
Αν ένας ερευνητής αποκλειστεί από το Claude, θα στραφεί άμεσα σε uncensored open-weights μοντέλα. Η επιβολή «ψηφιακού διαβατηρίου» στην επιστημονική έρευνα ενδέχεται να επιβραδύνει κρίσιμες ανακαλύψεις για νέα φάρμακα, χωρίς να αποτρέψει τον πραγματικά κακόβουλο παράγοντα. Η τεχνολογία δεν μπορεί να περιοριστεί με ημίμετρα όταν ο κώδικας διανέμεται ελεύθερα.
Συχνές Ερωτήσεις για την AI ασφάλεια
Τι σημαίνει τεχνητή νοημοσύνη διπλής χρήσης;
Αναφέρεται σε μοντέλα των οποίων οι ικανότητες μπορούν να αξιοποιηθούν εξίσου για θεμιτούς επιστημονικούς σκοπούς (όπως εμβόλια) ή για κακόβουλες επιθέσεις (όπως βιολογικά όπλα).
Μπορεί ένα LLM να συνθέσει αυτόνομα έναν ιό;
Όχι αυτόνομα, καθώς απαιτείται εξειδικευμένος εργαστηριακός εξοπλισμός, αλλά μπορεί να προσφέρει αναλυτικές οδηγίες σύνθεσης και παράκαμψης των φυσικών μηχανισμών άμυνας.
Γιατί η Anthropic μπλόκαρε ερευνητές που μελετούσαν ιούς;
Επειδή τα πειράματα συνδέονταν με στρατιωτικές εγκαταστάσεις και οι χρήστες προσπάθησαν να αποκρύψουν την ταυτότητά τους μέσω παραποιημένων IP διευθύνσεων.
Πώς παρακάμπτονται τα γεωγραφικά μπλόκα των εταιρειών AI;
Οι χρήστες επιστρατεύουν εξελιγμένα δίκτυα οικιακών proxies (residential VPNs) και εικονικούς λογαριασμούς πληρωμών για να εμφανίζονται ως κάτοικοι επιτρεπόμενων χωρών.
Υπάρχει τρόπος ελέγχου στα τοπικά μοντέλα ανοιχτού κώδικα;
Όχι, από τη στιγμή που τα αρχεία βαρών (weights) κατέβουν σε ιδιωτικό υλικό, ο έλεγχος από κεντρικούς διακομιστές καθίσταται τεχνικά ανέφικτος.
Τι είναι το σύστημα vetting για επιστήμονες;
Πρόκειται για πρόταση θέσπισης αυστηρής πιστοποίησης ταυτότητας και ιστορικού των ερευνητών πριν τους δοθεί πρόσβαση σε εξειδικευμένα βιολογικά μοντέλα.

