Κυριακή, 16 Αυγούστου 2026

Το Claude θα κρύβει πλέον μυστική υπογραφή σε ό,τι γράφει

Η ταυτοποίηση AI-generated content έχει εξελιχθεί σε ένα από τα πιο καυτά και κρίσιμα ζητήματα της σύγχρονης τεχνολογίας. Καθώς τα μοντέλα γίνονται ολοένα πιο «ανθρώπινα» στο ύφος, στην επιχειρηματολογία και στη γλωσσική τους ροή, το να ξεχωρίσεις τι γράφτηκε από άνθρωπο και τι από AI παύει να είναι προφανές. Σε αυτό το πλαίσιο, η Anthropic παρουσιάζει μια λύση που, αν πετύχει στην πράξη, μπορεί να αλλάξει τους κανόνες του παιχνιδιού: το Claude θα ενσωματώνει πλέον μυστική υπογραφή σε ό,τι γράφει, ένα αόρατο watermark που θα λειτουργεί ως ψηφιακό «ίχνος» μέσα στο ίδιο το κείμενο.

Η κίνηση αυτή έρχεται σε ευθυγράμμιση με τους νέους κανόνες διαφάνειας της Ευρωπαϊκής Ένωσης για την τεχνητή νοημοσύνη, αλλά το ενδιαφέρον είναι ότι δεν περιορίζεται στην ευρωπαϊκή αγορά. Αντίθετα, η Anthropic επιλέγει να ενεργοποιήσει τη μυστική υπογραφή του Claude παγκοσμίως, ώστε να υπάρχει ενιαία συμπεριφορά και να αποφεύγονται περίπλοκες γεωγραφικές εξαιρέσεις που, στην πράξη, συχνά καταρρέουν.

Πώς το Claude θα κρύβει πλέον μυστική υπογραφή σε ό,τι γράφει

Σε αντίθεση με παλιότερες προσπάθειες «σήμανσης» περιεχομένου, εδώ δεν μιλάμε για κάτι που θα φαίνεται με γυμνό μάτι. Δεν θα δεις περίεργους χαρακτήρες, δεν θα παρατηρήσεις αλλοιωμένη στίξη, ούτε θα προστεθούν κρυφά σύμβολα που μπορούν εύκολα να διαγραφούν με ένα copy-paste σε άλλο περιβάλλον. Η μυστική υπογραφή ενσωματώνεται μέσα στις ίδιες τις επιλογές των λέξεων, με τρόπο που είναι ουσιαστικά αόρατος στον αναγνώστη, αλλά ανιχνεύσιμος για όποιον διαθέτει το σωστό κλειδί αποκωδικοποίησης.

Για να το καταλάβουμε πιο καθαρά: όταν ένα language model γράφει, δεν «ξέρει» εξαρχής ολόκληρη την παράγραφο. Παράγει κείμενο βήμα-βήμα, επιλέγοντας κάθε φορά την επόμενη λέξη (ή token) από μια λίστα πιθανών επιλογών που ταιριάζουν στο context. Υπό φυσιολογικές συνθήκες, η τελική επιλογή επηρεάζεται από πιθανότητες και από έναν μηχανισμό τυχαιότητας.

Με ενεργό watermarking, το Claude δεν επιλέγει απλώς «την πιο πιθανή λέξη» ή «μια τυχαία από τις πιθανές». Χρησιμοποιεί ένα κρυφό κλειδί, το οποίο καθοδηγεί συστηματικά τις επιλογές του ώστε να δημιουργείται ένα συγκεκριμένο μοτίβο μέσα στο κείμενο. Στο παράδειγμα που δίνει η Anthropic, το κλειδί βασίζεται στα ψηφία του π. Αν το κλειδί ξεκινάει από το 2, η επιλογή της επόμενης λέξης μπορεί να είναι η έκτη στη λίστα, μετά η πέμπτη, μετά η τρίτη, μετά πάλι η πέμπτη κ.ο.κ. Το αποτέλεσμα είναι ένα στατιστικό «αποτύπωμα» που δεν φαίνεται, αλλά μπορεί να αναγνωριστεί με τον σωστό αλγόριθμο.

Η προσέγγιση θυμίζει και επεκτείνει την κατεύθυνση της SynthID-Text μεθόδου του Google DeepMind, η οποία δημοσιεύθηκε στο Nature. Το σημαντικό εδώ είναι το πρακτικό: σύμφωνα με την Anthropic, η διαδικασία δεν υποβαθμίζει την ποιότητα του κειμένου, δεν επιβραδύνει αισθητά το output και δεν προσθέτει επιπλέον κόστος σε tokens. Με άλλα λόγια, η μυστική υπογραφή «κουμπώνει» πάνω στη φυσική λειτουργία του μοντέλου, χωρίς να αλλάζει την εμπειρία χρήσης.

Τι μπορεί να ανιχνεύσει το watermarking και πού έχει όρια

Όπως κάθε τεχνική, έτσι και αυτή έχει περιορισμούς — και είναι χρήσιμο να τους γνωρίζουμε για να μην καλλιεργούνται λανθασμένες προσδοκίες.

Πρώτον, το watermarking μπορεί να δείξει ότι το Claude συμμετείχε στη δημιουργία ενός κειμένου, όχι απαραίτητα ότι το έγραψε από το μηδέν. Αν δώσεις στο Claude ένα δικό σου κείμενο για επιμέλεια, το τελικό αποτέλεσμα μπορεί να φέρει μυστική υπογραφή, ακόμα κι αν μεγάλο μέρος των ιδεών και της δομής ήταν ανθρώπινο. Το ίδιο ισχύει για μεταφράσεις: ένα κείμενο που πέρασε από το Claude ως μετάφραση είναι πιθανό να «σημαδευτεί».

Δεύτερον, το μήκος και το είδος της παρέμβασης παίζουν ρόλο. Αν το κείμενο είναι πολύ σύντομο ή αν το Claude έκανε απλώς ένα ελαφρύ proofreading με ελάχιστες αλλαγές, το watermark μπορεί να μην είναι αρκετά ισχυρό για να ανιχνευθεί με βεβαιότητα. Η υπογραφή βασίζεται σε μοτίβα που χρειάζονται «χώρο» για να εμφανιστούν στατιστικά.

Τρίτον, οι ελαφριές επεξεργασίες πάνω σε Claude-generated κείμενο συνήθως δεν αφαιρούν το watermark. Αυτό είναι κομβικό: δεν αρκεί ένα πρόχειρο edit ή μερικές αλλαγές λέξεων για να εξαφανιστεί η μυστική υπογραφή. Για να είσαι πραγματικά σίγουρος ότι έχει χαθεί, απαιτείται πλήρες rewrite από την αρχή, που αλλάζει ριζικά τη γλωσσική αλληλουχία.

Στον κώδικα, ωστόσο, τα πράγματα είναι πιο δύσκολα. Ο προγραμματισμός απαιτεί ακρίβεια και έχει πολύ πιο «στενό» χώρο επιλογών για κάθε token. Αυτό σημαίνει ότι σε αρκετές περιπτώσεις το watermarking είναι πιο αραιό, λιγότερο αξιόπιστο ή και πρακτικά αδύνατο, επειδή το μοντέλο δεν μπορεί να «διαλέξει εναλλακτικές» χωρίς να σπάσει τη λειτουργικότητα.

Τι έρχεται για τον έλεγχο και τη διαφάνεια

Η Anthropic σχεδιάζει να διαθέσει API που θα επιτρέπει τον έλεγχο κειμένων με τα κατάλληλα κλειδιά αποκωδικοποίησης, ώστε τρίτοι να μπορούν να επαληθεύουν αν ένα κείμενο προήλθε από το Claude. Παράλληλα, για εικόνες που παράγονται μέσω Claude, θα υπάρχει κρυπτογραφικά υπογεγραμμένη σημείωση στα metadata — μια διαφορετική, αλλά συγγενής προσέγγιση σήμανσης.

Σε επίπεδο διάθεσης, οι αλλαγές θα ισχύουν για όλα τα Claude products που βασίζονται σε μοντέλα τα οποία κυκλοφόρησαν μετά τις αρχές Αυγούστου, ενώ η υποστήριξη για παλαιότερα μοντέλα θα προστεθεί σταδιακά μέσα στους επόμενους μήνες. Η επιλογή της παγκόσμιας εφαρμογής είναι επίσης ένα μήνυμα: η Anthropic δεν αντιμετωπίζει το ζήτημα ως «ευρωπαϊκή υποχρέωση», αλλά ως γενικό χαρακτηριστικό εμπιστοσύνης και ιχνηλασιμότητας.

Γιατί αυτό έχει σημασία τώρα

Από εδώ και πέρα, κάθε φορά που κάτι γράφτηκε με τη βοήθεια του Claude, θα υπάρχει ένας αόρατος τρόπος να αποδειχθεί. Και σε μια εποχή όπου το AI περιεχόμενο κυκλοφορεί μαζικά, όπου η παραπληροφόρηση μπορεί να «ντυθεί» με άψογη γραφή, και όπου η αξιοπιστία των πηγών δοκιμάζεται καθημερινά, το ότι το Claude θα κρύβει πλέον μυστική υπογραφή σε ό,τι γράφει μπορεί να εξελιχθεί σε ένα από τα πιο ουσιαστικά εργαλεία διαφάνειας των επόμενων χρόνων. Δεν λύνει όλα τα προβλήματα — ειδικά όταν υπάρχουν πολλαπλές πλατφόρμες και άπειροι τρόποι αναδιατύπωσης — αλλά ανεβάζει σημαντικά τον πήχη της ανιχνευσιμότητας και θέτει ένα νέο πρότυπο για το πώς θα πρέπει να «υπογράφεται» η συμμετοχή της τεχνητής νοημοσύνης στο περιεχόμενο.

Δείτε επίσης

Τελευταία Άρθρα

Τα πιο Δημοφιλή