Claude: Η Anthropic βάζει watermark σε κείμενα και αρχεία που δημιουργεί η AI

Claude: Η Anthropic βάζει watermark σε κείμενα και αρχεία που δημιουργεί η AI
The Claude logo is displayed on a computer screen photographed through a magnifying glass in Creteil, France, on April 21, 2026. The NSA is reported to have used Claude Mythos Preview despite a ban on Anthropic for United States government agencies. (Photo by Samuel Boivin/NurPhoto) (Photo by Samuel Boivin / NurPhoto via AFP) Photo: AFP
Η Anthropic εφαρμόζει αόρατα ψηφιακά σημάδια στα κείμενα και πιστοποιημένα metadata σε εικόνες και αρχεία του Claude, καθώς τίθενται σε εφαρμογή οι νέες απαιτήσεις διαφάνειας του ευρωπαϊκού AI Act.
  • Η Anthropic θα «μαρκάρει» τα κείμενα του Claude με αόρατο στατιστικό watermark, ώστε να μπορούν να αναγνωρίζονται ως προϊόν τεχνητής νοημοσύνης.
  • Σε αρχεία όπως PNG, JPG και SVG θα προστίθενται κρυπτογραφικά υπογεγραμμένα metadata βάσει του προτύπου C2PA.
  • Το σύστημα δεν αποτελεί απόλυτη απόδειξη ότι κάτι γράφτηκε εξ ολοκλήρου από AI, καθώς εκτεταμένη επεξεργασία ή πλήρης επανεγγραφή μπορεί να καταστήσει το watermark μη ανιχνεύσιμο.

Η Anthropic προχωρά στην προσθήκη ψηφιακών «υδατογραφημάτων» στο περιεχόμενο που παράγεται μέσω του Claude, σε μια προσπάθεια να καταστήσει ευκολότερη την αναγνώριση υλικού που έχει δημιουργηθεί ή υποστεί επεξεργασία από τεχνητή νοημοσύνη.

Η κίνηση έρχεται καθώς η παραγωγή περιεχομένου μέσω generative AI εξαπλώνεται με ταχύτατους ρυθμούς σε κείμενα, εικόνες, μουσική, λογισμικό και βίντεο, ενώ παράλληλα γίνεται ολοένα δυσκολότερο να διαχωριστεί το συνθετικό περιεχόμενο από εκείνο που έχει δημιουργηθεί αποκλειστικά από ανθρώπους.

Σύμφωνα με ανάλυση της Ahrefs το 2025 σε περίπου 900.000 νέες ιστοσελίδες, σχεδόν τα τρία τέταρτα περιείχαν σε κάποιο βαθμό κείμενο που είχε παραχθεί από AI.

Το ευρωπαϊκό AI Act αλλάζει τους κανόνες

Η νέα πολιτική της Anthropic συνδέεται άμεσα με τις απαιτήσεις του AI Act της Ευρωπαϊκής Ένωσης.

Το Άρθρο 50(2) απαιτεί από τους παρόχους generative AI να διασφαλίζουν ότι συνθετικό κείμενο, εικόνα, ήχος και βίντεο επισημαίνονται σε μηχαναγνώσιμη μορφή και μπορούν, όσο αυτό είναι τεχνικά εφικτό, να αναγνωρίζονται ως τεχνητά παραγόμενα ή τροποποιημένα. Οι συγκεκριμένες υποχρεώσεις εφαρμόζονται από τις 2 Αυγούστου 2026.

Η Anthropic συγκαταλέγεται στις περίπου 190 εταιρείες και οργανισμούς που έχουν υπογράψει τον ευρωπαϊκό Code of Practice on Transparency of AI-Generated Content, ο οποίος λειτουργεί ως εθελοντικό πλαίσιο για τη συμμόρφωση με τις υποχρεώσεις διαφάνειας του AI Act.

Πώς θα «μαρκάρονται» τα κείμενα του Claude

Στα κείμενα, η Anthropic χρησιμοποιεί τεχνολογία βασισμένη στο SynthID-Text της Google DeepMind.

Σε αντίθεση με ένα συμβατικό watermark, το σύστημα δεν προσθέτει κρυφούς χαρακτήρες ή metadata μέσα σε ένα έγγραφο.

Το υδατογράφημα δημιουργείται μέσα από τις ίδιες τις λέξεις που επιλέγει το μοντέλο κατά την παραγωγή του κειμένου.

Τα μεγάλα γλωσσικά μοντέλα επιλέγουν κάθε επόμενη λέξη ανάμεσα σε πολλές πιθανές επιλογές. Με το watermarking, ένα μυστικό κλειδί και το προηγούμενο κείμενο επηρεάζουν ελαφρώς αυτές τις επιλογές.

Σε ένα αρκετά μεγάλο κείμενο, οι μικρές αυτές διαφοροποιήσεις σχηματίζουν ένα στατιστικό μοτίβο, το οποίο μπορεί στη συνέχεια να αναζητηθεί από ειδικό σύστημα ανίχνευσης.

Για τον αναγνώστη, πάντως, το κείμενο δεν αλλάζει εμφανώς.

Τι αλλάζει σε εικόνες και αρχεία

Διαφορετική τεχνολογία χρησιμοποιείται για αρχεία όπως PNG, JPG και SVG.

Σε αυτές τις περιπτώσεις, το Claude προσθέτει στα metadata του αρχείου μια κρυπτογραφικά υπογεγραμμένη ένδειξη, βασισμένη στο ανοικτό πρότυπο C2PA.

Η ίδια η εικόνα δεν αλλάζει οπτικά. Αντίθετα, το αρχείο περιλαμβάνει πληροφορία που πιστοποιεί ότι το Claude συμμετείχε στη δημιουργία ή την επεξεργασία του.

Το ψηφιακό πιστοποιητικό δεν περιλαμβάνει, σύμφωνα με την εταιρεία, προσωπικά δεδομένα του χρήστη, ενώ η κρυπτογραφική υπογραφή μπορεί να βοηθήσει και στον εντοπισμό μεταγενέστερης αλλοίωσης των metadata.

ΔΙΑΒΑΣΤΕ ΑΚΟΜΑ

Το watermark θα ακολουθεί το περιεχόμενο και εκτός Claude

Η εφαρμογή δεν περιορίζεται στις επίσημες εφαρμογές του Claude.

Σύμφωνα με την Anthropic, το marking θα εφαρμόζεται στα υποστηριζόμενα μοντέλα όπου κι αν χρησιμοποιούνται, συμπεριλαμβανομένων του Claude Platform API, των εφαρμογών Claude, Claude Code και άλλων υπηρεσιών του οικοσυστήματος.

Αυτό σημαίνει ότι το watermark μπορεί να υπάρχει και σε περιεχόμενο που δημιουργείται από τρίτες εφαρμογές οι οποίες χρησιμοποιούν το API της Anthropic, καθώς ενσωματώνεται στην ίδια την έξοδο του μοντέλου.

Παγκόσμια εφαρμογή, όχι μόνο στην Ευρώπη

Παρότι η νομοθετική υποχρέωση προέρχεται από την Ευρωπαϊκή Ένωση, η Anthropic σχεδιάζει να εφαρμόσει το σύστημα παγκοσμίως.

Η ευρωπαϊκή νομοθεσία προβλέπει ότι τα συστήματα που εμπίπτουν στο Άρθρο 50 πρέπει να συμμορφώνονται με τις απαιτήσεις marking και detection, ενώ για ορισμένα παλαιότερα συστήματα προβλέπεται μεταβατική περίοδος.

Το watermark δεν είναι απόλυτη απόδειξη

Η ίδια η Anthropic αναγνωρίζει ότι η ύπαρξη watermark πρέπει να αντιμετωπίζεται ως ένδειξη και όχι ως αδιάσειστη απόδειξη ότι ένα κείμενο γράφτηκε εξ ολοκλήρου από AI.

Το σύστημα δεν μπορεί, για παράδειγμα, να διακρίνει εύκολα ανάμεσα σε ένα κείμενο που δημιούργησε από το μηδέν το Claude και σε ένα ανθρώπινο κείμενο το οποίο το μοντέλο επεξεργάστηκε εκτενώς.

Αντίστοιχα, μια μετάφραση που παράγεται εξ ολοκλήρου από το Claude μπορεί να φέρει πλήρες watermark, ακόμη και αν το πρωτότυπο κείμενο είναι ανθρώπινο.

Μπορεί να αφαιρεθεί με εκτεταμένο rewriting

Υπάρχει επίσης ένας σημαντικός περιορισμός.

Μικρές αλλαγές στο κείμενο ενδέχεται να μην αρκούν για να εξαφανίσουν το στατιστικό μοτίβο, ωστόσο μια εκτεταμένη επανεγγραφή, παραφράση ή μετάφραση μπορεί να το αποδυναμώσει σε τέτοιο βαθμό ώστε να μην είναι πλέον ανιχνεύσιμο.

Μια πλήρης επανεγγραφή, όπου ουσιαστικά αντικαθίσταται κάθε λέξη, μπορεί να εξαλείψει το watermark.

Αυτό σημαίνει ότι η τεχνολογία δεν αποτελεί από μόνη της λύση απέναντι σε όσους επιχειρούν σκόπιμα να κρύψουν τη χρήση AI.

Γιατί τα AI watermarks αποκτούν μεγαλύτερη σημασία

Η ανάγκη αναγνώρισης περιεχομένου τεχνητής νοημοσύνης δεν αφορά μόνο περιπτώσεις όπως ακαδημαϊκές εργασίες ή επαγγελματικά συμβόλαια όπου απαγορεύεται η χρήση AI.

Το μεγαλύτερο ζήτημα αφορά την παραπληροφόρηση και την ασφάλεια, καθώς η παραγωγή πειστικών ψεύτικων εικόνων, εγγράφων, ηχητικών αποσπασμάτων και βίντεο γίνεται ολοένα ευκολότερη.

Ένα παραποιημένο βίντεο δημόσιου προσώπου, ένα πλαστό επίσημο έγγραφο ή ένα ψεύτικο ηχητικό απόσπασμα μπορούν να έχουν πολύ σοβαρότερες συνέπειες από την απλή απόκρυψη του γεγονότος ότι ένα κείμενο γράφτηκε από AI.

Τα watermarks και τα πρότυπα ψηφιακής προέλευσης δεν εξαλείφουν το πρόβλημα, αλλά αποτελούν ένα ακόμη εργαλείο για τη διαφάνεια, την εξακρίβωση της προέλευσης και την αντιμετώπιση του παραπλανητικού AI-generated content.

ΔΙΑΒΑΣΤΕ ΠΕΡΙΣΣΟΤΕΡΕΣ ΕΙΔΗΣΕΙΣ: