ChatGPT: Έρχεται αόρατο watermark στα κείμενα σε Ελλάδα και ΕΕ

Η OpenAI ενσωματώνει αόρατο watermark με την ονομασία textGrain στα κείμενα του ChatGPT στην . Αυτή η παρέμβαση αλλάζει ριζικά τον τρόπο διαχείρισης του παραγόμενου περιεχομένου. Αν χρησιμοποιείς τεχνητή νοημοσύνη για κείμενα ή κώδικα, ο εντοπισμός γίνεται πλέον καθαρά στατιστικός.

✂️ Σύνοψη άρθρου

  • Το textGrain εισάγει στατιστικό αποτύπωμα επηρεάζοντας την επιλογή των tokens χωρίς ορατούς χαρακτήρες.
  • Η ανίχνευση πέφτει κατακόρυφα από το 92% στο 17% αν τροποποιηθεί μόλις το 25% των λέξεων.
  • Η τεχνολογία ενεργοποιείται υποχρεωτικά στην λόγω του , αλλά το εργαλείο ελέγχου μένει κλειστό για το κοινό.

Πώς λειτουργεί το textGrain στην πράξη

Η OpenAI δεν χρησιμοποιεί ορατά στοιχεία, υδατογραφήματα εικόνας ή κρυφούς χαρακτήρες Unicode (zero-width spaces). Αντίθετα, παρεμβαίνει στον ίδιο τον πυρήνα παραγωγής των tokens.

Κάθε φορά που ένα γλωσσικό μοντέλο παράγει την επόμενη λέξη, υπολογίζει έναν πίνακα πιθανοτήτων για εκατοντάδες υποψήφιες επιλογές. Το textGrain εισάγει μια ελαφριά στατιστική προτίμηση σε συγκεκριμένες υποομάδες λέξεων, δημιουργώντας ένα μαθηματικό μοτίβο σε βάθος παραγράφου.

Ο αναγνώστης διαβάζει απόλυτα φυσικό κείμενο χωρίς συντακτικά λάθη. Ένας εξειδικευμένος ανιχνευτής όμως υπολογίζει τη μαθηματική κατανομή και εντοπίζει άμεσα αν το κείμενο προέρχεται από τα μοντέλα της εταιρείας.

Πόσο αντέχει το αόρατο watermark

Στην πράξη, η ανθεκτικότητα του textGrain εξαρτάται άμεσα από την έκταση και τις επεμβάσεις που δέχεται το κείμενο. Σύμφωνα με τις μετρήσεις σε κείμενα 400 tokens (περίπου 300 λέξεις), το σήμα ανιχνεύεται με ακρίβεια 92% όταν το κείμενο μένει ανέπαφο.

Όταν αντικατασταθεί μόλις το 10% των λέξεων με συνώνυμα, η ικανότητα εντοπισμού υποχωρεί στο 66%. Με αλλαγή του 25% του περιεχομένου, η αξιοπιστία του ανιχνευτή καταρρέει στο 17%, καθιστώντας τον ουσιαστικά άχρηστο.

Επίπεδο Επεξεργασίας Κειμένου Ποσοστό Ανίχνευσης (Recall) Επιπτώσεις στην Πράξη
Αυτούσιο κείμενο (0% αλλαγές) 92% Άμεσος εντοπισμός από το σύστημα
Ελαφριά επιμέλεια (10% αλλαγές) 66% Μειωμένη στατιστική βεβαιότητα
Ουσιαστικό rewriting (25% αλλαγές) 17% Πλήρης αποτυχία αναγνώρισης
Μικρά κείμενα (<100 tokens) Ακαθόριστο Ανεπαρκές δείγμα για ασφαλές συμπέρασμα

Το ευρωπαϊκό πλαίσιο και ο AI Act

Η OpenAI δεν εισάγει το μέτρο από επιλογή, αλλά για να ευθυγραμμιστεί με τον ευρωπαϊκό κανονισμό για την τεχνητή νοημοσύνη (EU AI Act). Ο νόμος απαιτεί υποχρεωτική σήμανση συνθετικού περιεχομένου όπου αυτό είναι τεχνικά εφικτό.

Το μέτρο εφαρμόζεται οριζόντια στην ΕΕ για όλα τα συνδρομητικά πακέτα του ChatGPT, συμπεριλαμβανομένου του δωρεάν tier και των API. Αντίθετα, όπως αναφέρει το TechCrunch, για τους πελάτες API εκτός ευρωπαϊκού χώρου η σήμανση θα είναι προαιρετική.

Αξίζει να αποσαφηνιστεί ότι το αποτύπωμα δεν περιέχει προσωπικά δεδομένα. Δεν καταγράφει λογαριασμό χρήστη, prompt, ώρα δημιουργίας ή ιστορικό συνομιλίας.

Οι κίνδυνοι για SEO και ακαδημαϊκούς

Οι στατιστικοί ανιχνευτές κειμένου υποφέρουν διαχρονικά από δύο δομικά προβλήματα: ψευδώς θετικά (false positives) και ψευδώς αρνητικά (false negatives) αποτελέσματα. Ένα αυθεντικό κείμενο γραμμένο από άνθρωπο μπορεί να συμπέσει τυχαία με το στατιστικό μοτίβο του textGrain.

Γι’ αυτόν τον λόγο, η OpenAI περιορίζει αρχικά την πρόσβαση στο εργαλείο ανίχνευσης μόνο σε ελεγμένους ερευνητές. Αν το εργαλείο δινόταν ελεύθερα σε καθηγητές ή αξιολογητές, θα οδηγούσε σε άδικες κατηγορίες εις βάρος δημιουργών και φοιτητών.

Στο πεδίο του SEO και των μηχανών αναζήτησης, το ζήτημα είναι εξίσου σοβαρό. Παρότι η Google δηλώνει πως αξιολογεί την ποιότητα ανεξαρτήτως τρόπου συγγραφής, η μαζική διαρροή σημαδεμένων κειμένων διευκολύνει τα αυτοματοποιημένα φίλτρα κατάταξης να υποβαθμίζουν μη πρωτότυπο υλικό.

Η άποψή μας στο TechNoid

Το textGrain είναι ένα τυπικό δείγμα τεχνικού συμβιβασμού για συμμόρφωση με τους νομοθέτες των Βρυξελλών. Στην ουσία του, λειτουργεί ως παγίδα μόνο για όσους κάνουν τυφλό copy-paste από το ChatGPT χωρίς ίχνος επιμέλειας.

Κάθε χρήστης που γνωρίζει πώς να γράφει, να μεταφράζει ή να ξαναδουλεύει το προσχέδιό του, εξουδετερώνει το watermark μέσα σε δύο λεπτά. Θεωρούμε απόλυτα σωστή την απόφαση να μην κυκλοφορήσει δημόσιο εργαλείο ελέγχου, καθώς η αγορά βρίθει από αναξιόπιστους AI detectors που προκαλούν σύγχυση.

Συχνές Ερωτήσεις για το ChatGPT Watermark

Μπορεί κάποιος να δει το watermark με γυμνό μάτι;

Όχι, δεν υπάρχουν ορατά σύμβολα, κενά ή ειδικοί χαρακτήρες μέσα στο κείμενο. Η σήμανση βασίζεται αποκλειστικά σε μαθηματικές πιθανότητες επιλογής λέξεων.

Επηρεάζονται οι χρήστες εκτός Ευρωπαϊκής Ένωσης;

Όχι με τον ίδιο τρόπο. Για χρήστες API εκτός ΕΕ το textGrain παραμένει απενεργοποιημένο εκτός αν επιλεγεί ρητά.

Μπορεί ένας καθηγητής να ελέγξει αν έγραψα εργασία με ChatGPT;

Όχι άμεσα μέσω της OpenAI, καθώς ο ανιχνευτής δεν διατίθεται ελεύθερα στο κοινό ή σε εκπαιδευτικά ιδρύματα.

Τι συμβαίνει αν μεταφράσω το κείμενο σε άλλη γλώσσα;

Η μετάφραση αναδιατάσσει πλήρως τα tokens και τη σύνταξη, καταστρέφοντας σχεδόν ολοκληρωτικά το στατιστικό αποτύπωμα.

Αποκαλύπτονται τα στοιχεία του λογαριασμού μου μέσω του watermark;

Όχι, το textGrain δεν φέρει μεταδεδομένα ταυτότητας χρήστη, λογαριασμού ή ιστορικού συνομιλίας.

Dimitris Marizas
Dimitris Marizashttps://technoid.gr
Γράφω για τεχνολογία από τη σκοπιά του ανθρώπου που τη χρησιμοποιεί καθημερινά — όχι από αίθουσες συνεδρίων. Ασχολούμαι με δίκτυα, δορυφορικό internet, smartphones και ψηφιακές υπηρεσίες, με έμφαση στο τι σημαίνουν αυτά πρακτικά για τον Έλληνα χρήστη. Πίσω από κάθε άρθρο κρύβεται ώρες ανάλυσης, δοκιμών και — όταν χρειάζεται — κριτικής σε ό,τι το marketing προσπαθεί να κρύψει.

ΑΦΗΣΤΕ ΜΙΑ ΑΠΑΝΤΗΣΗ

εισάγετε το σχόλιό σας!
παρακαλώ εισάγετε το όνομά σας εδώ