12.08.2026
7’ READ TIME

To Claude βάζει αόρατη υπογραφή στα κείμενά του. Αλλά μπορεί να «σβήσει»

Η Anthropic βάζει machine-readable watermark στα κείμενα του Claude, καθώς οι νέοι κανόνες του AI Act για τη διαφάνεια του συνθετικού περιεχομένου μπαίνουν σε εφαρμογή. Το δύσκολο μέρος, όμως, είναι να παραμείνει το αποτύπωμα εκεί.
Ο στόχος του AI Act δεν είναι να εξαφανίσει το AI-generated content. Είναι να κάνει δυσκολότερη την κυκλοφορία του χωρίς καμία ένδειξη ότι είναι συνθετικό. Φωτ.: Samuel Boivin/NurPhoto via Getty Images/Ideal Image
Billboard 1

Η Anthropic ανακοίνωσε ότι θα ενσωματώνει αόρατα, machine-readable watermarks στα κείμενα που παράγουν τα νέα μοντέλα Claude, ενώ στα αρχεία εικόνας θα προσθέτει ψηφιακά υπογεγραμμένα metadata προέλευσης. Η αλλαγή έρχεται τη στιγμή που τίθενται σε εφαρμογή οι νέες απαιτήσεις διαφάνειας του AI Act της Ευρωπαϊκής Ένωσης.

Το ενδιαφέρον είναι ότι η Anthropic δεν περιορίζει το μέτρο στην ευρωπαϊκή αγορά. Η εταιρεία αναφέρει ότι τα νέα μοντέλα που κυκλοφορούν από τις 2 Αυγούστου 2026 και μετά θα φέρουν τις σημάνσεις αυτές, με στόχο η προσέγγιση να εφαρμοστεί παγκοσμίως.

Στόχος είναι να γίνει δυσκολότερο να κυκλοφορεί συνθετικό περιεχόμενο χωρίς καμία ένδειξη της προέλευσής του, ιδιαίτερα σε περιπτώσεις παραπληροφόρησης, απάτης, χειραγώγησης ή εξαπάτησης των καταναλωτών.

Ο χρήστης δεν θα βλέπει κάποιο σύμβολο στην οθόνη ούτε χρειάζεται να ενεργοποιήσει κάτι. Το watermark ενσωματώνεται στο ίδιο το κείμενο και, σύμφωνα με την Anthropic, δεν αλλάζει το νόημα, την ποιότητα ή την αναγνωσιμότητά του. Μπορεί επίσης να επιβιώσει από την αντιγραφή και επικόλληση και από ορισμένες μορφές επεξεργασίας, υποστηρίζει η εταιρεία.

Ο Giovanni Puccetti, ο οποίος έχει εργαστεί ως συγγραφέας μελέτης για την Ευρωπαϊκή Επιτροπή πάνω σε τεχνικές λύσεις για τη σήμανση και ανίχνευση AI-generated text στο πλαίσιο του Article 50(2), χαρακτηρίζει την κίνηση της Anthropic «θετική βελτίωση» προς την κατεύθυνση να γίνουν τα AI-generated outputs αναγνωρίσιμα. Όπως εξηγεί στο WIRED Greece, το watermark αναμένεται να κάνει τα outputs των μοντέλων της ανιχνεύσιμα, εκτός εάν υποστούν σημαντική επεξεργασία από ανθρώπους ή άλλα generative AI μοντέλα.

Οι λεπτομέρειες του μηχανισμού, ωστόσο, δεν έχουν ακόμη δημοσιοποιηθεί.

Τι ακριβώς είναι το watermark στο κείμενο

Η λέξη «watermark» μπορεί να δημιουργεί λανθασμένη εικόνα. Δεν πρόκειται για ένα αόρατο υδατογράφημα, για logo που κρύβεται ανάμεσα στις λέξεις, ούτε για κρυφούς χαρακτήρες στο κείμενο.

Όπως εξηγεί στο WIRED Greece ο Γιώργος Μικρός, καθηγητής Υπολογιστικής Γλωσσολογίας στο Hamad Bin Khalifa University του Κατάρ, το υδατογράφημα μπορεί να ενσωματώνεται ως στατιστικό μοτίβο στις επιλογές που κάνει το μοντέλο κατά την παραγωγή του κειμένου.

Ένα μεγάλο γλωσσικό μοντέλο επιλέγει κάθε φορά την επόμενη λέξη με βάση μια κατανομή πιθανοτήτων. Ένα watermark μπορεί να μετατοπίζει ελαφρά αυτές τις πιθανότητες, ώστε συγκεκριμένες επιλογές λέξεων να εμφανίζονται λίγο συχνότερα ή σπανιότερα από ό,τι θα συνέβαινε χωρίς τη σήμανση.

Η αλλαγή σε κάθε μεμονωμένη επιλογή είναι αρκετά μικρή ώστε να μην γίνεται αντιληπτή από τον αναγνώστη. Σε ένα μεγαλύτερο κείμενο, όμως, οι μικρές αποκλίσεις μπορούν να συσσωρευτούν σε ένα στατιστικό μοτίβο που ένας ειδικός detector μπορεί να αναζητήσει.

Ο κ. Μικρός σημειώνει πως αυτό «είναι στατιστικά ανιχνεύσιμο και μπορεί να χρησιμοποιηθεί ως ένδειξη χρήσης του συγκεκριμένου μοντέλου».

Παράλληλα, αναφέρει πως «θεωρητικά είναι απολύτως εφικτό να υπάρχει ένα τέτοιο αποτύπωμα χωρίς αισθητή υποβάθμιση του ύφους ή της αναγνωσιμότητας». 

Η ανθεκτικότητα του υδατογραφήματος και η πιθανότητα παράκαμψης

Ένα κρίσιμο ερώτημα είναι αν το αποτύπωμα επιβιώνει -και σε τι βαθμό- μετά από επεξεργασία.

«Όσο περισσότερο ένα κείμενο υφίσταται ανθρώπινη επιμέλεια, αναδιατύπωση, παράφραση, μετάφραση ή συνδυάζεται με κείμενο άλλης προέλευσης, τόσο αυξάνεται η πιθανότητα το στατιστικό σήμα να εξασθενήσει ή να χαθεί», αναφέρει ο καθηγητής. Και υπογραμμίζει πως η ίδια η Anthropic αναγνωρίζει αυτές τις περιπτώσεις ως περιορισμούς της μεθόδου, κάτι που έχει παραδεχθεί και η OpenAI, εξετάζοντας την τεχνολογία αυτή.

Ο κ. Puccetti, ερευνητής στο Institute of Science and Technologies of Information (ISTI), με ειδίκευση στην ανίχνευση περιεχομένου που παράγεται από AI, συμφωνεί ότι η σημαντική επεξεργασία από ανθρώπους ή άλλα generative AI μοντέλα μπορεί να κάνει ένα watermark μη ανιχνεύσιμο. Στη δεύτερη περίπτωση, όμως, βλέπει ένα διαφορετικό πρόβλημα, αλλά και μια πιθανή λύση: τη διαλειτουργικότητα.

Επιπλέον, σύμφωνα με τον κ. Μικρό, δεν είναι δύσκολο να «σβήσει» ένα τέτοιο υδατογράφημα. Μάλιστα, μπορεί να σβήσει και οριστικά, «αν πάρουμε ένα κείμενο που έχει αρχικά παραχθεί π.χ.  από το Claude και ζητήσουμε από ένα κινέζικο ανοιχτό μοντέλο π.χ. το Kimi, να το ξαναγράψει». 

Ο καθηγητής εξηγεί ότι τα κινεζικά μοντέλα -και όχι μόνο· φέρνει ως παράδειγμα το Grok του Elon Musk- δεν υπακούουν σε ρυθμιστικά πλαίσια αυτού του τύπου και, με δεδομένο αυτό, «η πραγματική χρησιμότητα του κειμενικού υδατογραφήματος είναι μάλλον μικρή».

Η εκτίμησή του είναι ότι, εάν τα watermarks γενικευτούν και οι μεγάλες εταιρείες επιμείνουν, οι χρήστες θα μπορούν να χρησιμοποιούν ένα δεύτερο μοντέλο για την τελική αναδιαμόρφωση ενός κειμένου και να αποδυναμώνουν ή να αφαιρούν το αρχικό watermark.

Ο κ. Puccetti επισημαίνει ότι αν τα συστήματα σήμανσης λειτουργούσαν διαλειτουργικά μεταξύ διαφορετικών παρόχων, το πρόβλημα θα ήταν διαφορετικό: ένα κείμενο που περνά από ένα μοντέλο σε ένα άλλο θα μπορούσε, τουλάχιστον θεωρητικά, να παραμένει ανιχνεύσιμο.

«Αυτός είναι, κατά τη γνώμη μου, ο βασικός περιορισμός της χρήσης text watermarking για τη συμμόρφωση με το Article 50 του AI Act», σημειώνει. Η διαλειτουργικότητα, εξηγεί, είναι δύσκολο να επιτευχθεί χωρίς ρητή συνεργασία μεταξύ των παρόχων generative AI, αλλά και μεταξύ των ίδιων των παρόχων και των δημόσιων φορέων.

Το ζήτημα της διαλειτουργικότητας βρίσκεται ήδη στο επίκεντρο του ευρωπαϊκού Code of Practice για τη διαφάνεια του AI-generated content. Ο κ. Puccetti σημειώνει ότι ο Κώδικας αναγνωρίζει την απουσία υφιστάμενων διαλειτουργικών λύσεων και επιχειρεί να την αντιμετωπίσει ενθαρρύνοντας τη συνεργασία. Η προσχώρηση της Anthropic στο σχετικό τμήμα του Κώδικα, προσθέτει, είναι ένα θετικό πρώτο βήμα. «Ελπίζω όχι το τελευταίο», υπογραμμίζει.

Το watermark δεν λέει απαραίτητα «το έγραψε το Claude»

Εξαιτίας όλων αυτών, προκύπτει μια κρίσιμη διάκριση. 

Ένα θετικό αποτέλεσμα δεν σημαίνει απαραίτητα «το Claude έγραψε αυτό το κείμενο», ότι είναι δηλαδή ο αρχικός συγγραφέας. Μπορεί να σημαίνει ότι το κείμενο πέρασε από το Claude σε κάποιο στάδιο. Για παράδειγμα, το μοντέλο μπορεί να το μετέφρασε, να το συνόψισε ή να το επιμελήθηκε. 

«Θα ήμουν ιδιαίτερα προσεκτικός στο να θεωρήσουμε ένα υδατογράφημα ως απόδειξη συγγραφικής πατρότητας από σύστημα ΤΝ», λέει ο κ. Μικρός. «Πρόκειται περισσότερο για ένδειξη προέλευσης (provenance)».

Η σήμανση μπορεί, λοιπόν, να λειτουργήσει ως ένδειξη πως ένα κείμενο «πιθανότατα παρήχθη ή, ακόμη σημαντικότερα, πέρασε σε κάποιο στάδιο από ένα συγκεκριμένο σύστημα ΤΝ», αναφέρει ο καθηγητής. 

Το αντίστροφο ισχύει επίσης: η απουσία watermark δεν αποδεικνύει ότι ένα κείμενο γράφτηκε αποκλειστικά από άνθρωπο. Το watermark μπορεί να έχει χαθεί μετά από επεξεργασία, μετάφραση, μετατροπή αρχείου ή χρήση διαφορετικού μοντέλου.

Και εδώ εμφανίζεται ένα πρακτικό ερώτημα: θα μπορούσε ένα τέτοιο σύστημα να χρησιμοποιηθεί, για παράδειγμα, για να εντοπιστούν βιβλία που έχουν γραφτεί ή επιμεληθεί με AI; Ο κ. Μικρός είναι επιφυλακτικός

«Στην περίπτωση ενός βιβλίου», απαντά, «μια τέτοια τεχνολογία θα μπορούσε να αποτελέσει ένα χρήσιμο πρόσθετο τεκμήριο ότι συγκεκριμένα τμήματα πέρασαν από ένα σύστημα ΤΝ, ιδιαίτερα εάν έχουν διατηρηθεί σχετικά αναλλοίωτα». Ωστόσο, ξεκαθαρίζει πως «δεν θα μπορούσε να αποδειχθεί τι είδους επεξεργασία έκανε το σύστημα ΤΝ (παραγωγή, περίληψη, επιμέλεια, μετάφραση, παράφραση κλπ.)». 

«Θα το έβλεπα επομένως ως ένα νέο εργαλείο ψηφιακής προέλευσης και ιχνηλασιμότητας αλλά σε καμία περίπτωση ως έναν αλάνθαστο ανιχνευτή χρήσης τεχνητής νοημοσύνης στη συγγραφική διαδικασία», τονίζει ο κ. Μικρός.

Γιατί τώρα;

Η αλλαγή συνδέεται άμεσα με το Άρθρο 50 του AI Act. Από τις 2 Αυγούστου 2026 εφαρμόζονται οι σχετικές υποχρεώσεις διαφάνειας, βάσει των οποίων οι πάροχοι γενετικής AI πρέπει να διασφαλίζουν ότι το παραγόμενο περιεχόμενο μπορεί να αναγνωρίζεται ως τεχνητά δημιουργημένο σε machine-readable σήμανση, με τρόπο που να είναι, όσο είναι τεχνικά εφικτό, αποτελεσματικός, διαλειτουργικός, ανθεκτικός και αξιόπιστος.

Η απαίτηση για διαλειτουργικότητα αποκτά έτσι ιδιαίτερη σημασία. Για τον κ. Puccetti, δεν αρκεί κάθε εταιρεία να αναπτύξει ένα watermark που λειτουργεί μόνο μέσα στο δικό της οικοσύστημα. Αν ένα κείμενο περνά από το Claude σε άλλο μοντέλο, ιδανικά η σήμανση θα πρέπει να παραμένει αναγνωρίσιμη. Χωρίς κοινά τεχνικά πρότυπα και συνεργασία μεταξύ των παρόχων, αυτό είναι δύσκολο να επιτευχθεί.

Το AI Act δεν επιβάλλει συγκεκριμένα watermarks. Το watermark είναι μία από τις τεχνικές λύσεις που μπορούν να χρησιμοποιήσουν οι πάροχοι για να ανταποκριθούν στην απαίτηση.

Στόχος είναι να γίνει δυσκολότερο να κυκλοφορεί συνθετικό περιεχόμενο χωρίς καμία ένδειξη της προέλευσής του, ιδιαίτερα σε περιπτώσεις παραπληροφόρησης, απάτης, χειραγώγησης ή εξαπάτησης των καταναλωτών.

Η Anthropic έχει υπογράψει τον σχετικό ευρωπαϊκό Code of Practice και τώρα μετατρέπει αυτή τη δέσμευση σε τεχνολογία.

Δεν είναι, πάντως, η πρώτη μεγάλη εταιρεία που αναζητά τέτοια λύση. Η Google έχει αναπτύξει το SynthID, ενώ η OpenAI, από την πλευρά της, έχει ήδη χρησιμοποιήσει watermarking σε εικόνα και ήχο και έχει ανακοινώσει ότι εργάζεται και για κείμενο.

Για αρχεία εικόνας, η Anthropic θα χρησιμοποιεί παράλληλα το ανοιχτό πρότυπο C2PA, προσθέτοντας ψηφιακά υπογεγραμμένα metadata προέλευσης σε μορφές όπως PNG, JPG και SVG. Η λογική είναι διαφορετική: το C2PA καταγράφει πληροφορίες για την προέλευση και την επεξεργασία ενός αρχείου, ενώ το watermark λειτουργεί ως σήμα ενσωματωμένο στο ίδιο το περιεχόμενο.

Τι ακολουθεί

Χωρίς τις τεχνικές λεπτομέρειες της Anthropic είναι δύσκολο να αξιολογηθεί πόσο ανθεκτικό είναι το watermark σε αλλοίωση και σκόπιμες προσπάθειες αφαίρεσης. 

Το ίδιο πρόβλημα υπάρχει και στα metadata. Ένα C2PA record μπορεί να προσφέρει πολύ περισσότερες πληροφορίες για την προέλευση ενός αρχείου, αλλά μπορεί να χαθεί όταν αυτό μετατραπεί, αποθηκευτεί ξανά ή γίνει screenshot.

Το μεγάλο στοίχημα, επομένως, δεν είναι μόνο αν η Anthropic μπορεί να βάλει watermark στο Claude, αλλά και αν οι εταιρείες AI μπορούν να συμφωνήσουν σε έναν τρόπο ώστε αυτά τα διαφορετικά αποτυπώματα να αναγνωρίζονται και να επιβιώνουν όταν το περιεχόμενο μετακινείται από το ένα μοντέλο στο άλλο.

Ο στόχος του AI Act δεν είναι να εξαφανίσει το AI-generated content. Είναι να κάνει δυσκολότερη την κυκλοφορία του χωρίς καμία ένδειξη ότι είναι συνθετικό.

Η Anthropic κάνει τώρα το πρώτο μεγάλο βήμα στα κείμενα. Το αν η αόρατη υπογραφή θα αποδειχθεί πραγματικά ανθεκτική ή απλώς ένα ακόμη τεχνικό στρώμα που μπορεί να αφαιρεθεί, θα κριθεί όταν το watermark βρεθεί απέναντι στον πραγματικό κόσμο.

© WIRED Greece. Επιτρέπεται η αναδημοσίευση αποσπασμάτων μόνο με ενεργό σύνδεσμο προς το πρωτότυπο άρθρο και σαφή αναφορά στο WIRED Greece.
Για πλήρη αναδημοσίευση απαιτείται προηγούμενη γραπτή άδεια.
Βασίλης Τατσιόπουλος, Ως Staff Writer στο WIRED Greece, γράφει για τη διασταύρωση τεχνολογίας και κουλτούρας. Με θητεία… Περισσότερα

Γράψου στο newsletter μας!

Κάνε εγγραφή στο newsletter του WIRED Greece για να λαμβάνεις κάθε εβδομάδα τις ιστορίες, τις ιδέες και τις τεχνολογίες που διαμορφώνουν το αύριο.

Με την εγγραφή σας, συμφωνείτε με τους Όρους Χρήσης μας (συμπεριλαμβανομένης της παραίτησης από ομαδικές αγωγές και των διατάξεων διαιτησίας) και αναγνωρίζετε την Πολιτική Απορρήτου μας.

MOST READ ARTICLES
Sidebar 1
Sidebar 1
READ ALSO