Η Anthropic ανακοίνωσε ότι τα μελλοντικά μοντέλα Claude θα παράγουν κείμενο που θα φέρει υδατογράφημα, ώστε να μπορεί να εκτιμηθεί η πιθανότητα συμμετοχής του μοντέλου στη συγγραφή του. Η αλλαγή συνδέεται άμεσα με τις απαιτήσεις του EU AI Act για τη σήμανση περιεχομένου που έχει παραχθεί από τεχνητή νοημοσύνη. Σύμφωνα με την εταιρεία, η μέθοδος εφαρμόζεται χωρίς ορατές παρεμβάσεις στο κείμενο και χωρίς πρακτική επίπτωση στην εμπειρία του αναγνώστη. Η Anthropic σημειώνει επίσης ότι αντίστοιχες πρακτικές αναμένεται να υιοθετήσουν και άλλοι μεγάλοι πάροχοι μοντέλων.
Τι αλλάζει στο Claude
Το βασικό μήνυμα της ανακοίνωσης είναι ότι το υδατογράφημα δεν λειτουργεί όπως τα ορατά σημάδια που συναντάμε σε εικόνες, έγγραφα ή φυσικά αντικείμενα. Δεν προστίθενται επιπλέον λέξεις, κρυφοί χαρακτήρες ή ειδικά tokens μέσα στο παραγόμενο κείμενο. Για τον τελικό αναγνώστη, ένα υδατογραφημένο κείμενο θα μοιάζει ουσιαστικά ίδιο με ένα κείμενο χωρίς σήμανση. Αυτό σημαίνει ότι η αλλαγή αφορά κυρίως τη δυνατότητα μεταγενέστερου ελέγχου και όχι τη μορφή του αποτελέσματος.
Η εταιρεία υπογραμμίζει ακόμη ότι η σήμανση δεν περιέχει στοιχεία ταυτοποίησης. Δεν μπορεί, όπως λέει, να συνδεθεί με συγκεκριμένο πρόσωπο, οργανισμό ή συνομιλία. Το υδατογράφημα αφορά το ίδιο το Claude και τον τρόπο με τον οποίο παράγει κείμενο, όχι τον χρήστη που το αξιοποίησε. Επίσης, η Anthropic διευκρινίζει ότι η λειτουργία θα ενεργοποιηθεί παγκοσμίως κατά την αρχική διάθεση, επειδή προς το παρόν δεν υπάρχει σταθερός τρόπος γεωγραφικού περιορισμού ανά περιοχή.
Πώς λειτουργεί τεχνικά η μέθοδος
Η λογική πίσω από το υδατογράφημα βασίζεται στον τρόπο με τον οποίο τα μεγάλα γλωσσικά μοντέλα επιλέγουν την επόμενη λέξη. Σε πολλές περιπτώσεις, το μοντέλο έχει περισσότερες από μία εύλογες επιλογές που δεν αλλάζουν ουσιαστικά το νόημα μιας πρότασης. Εκεί, η τελική επιλογή μπορεί να καθορίζεται από μια πηγή τυχαιότητας. Η Anthropic εξηγεί ότι το υδατογράφημα εκμεταλλεύεται ακριβώς αυτές τις «χαμηλού ρίσκου» επιλογές για να αφήσει ένα ανιχνεύσιμο μοτίβο μέσα στο κείμενο.
Η κρίσιμη λεπτομέρεια είναι ότι δεν αλλάζει το λεξιλόγιο του μοντέλου με αφύσικο τρόπο. Αντί για έναν αυθαίρετο γεννήτορα τυχαίων αριθμών, χρησιμοποιείται ένα κλειδί και οι προηγούμενες λέξεις για να καθοριστεί ποια από τις ήδη λογικές επιλογές θα προτιμηθεί. Με αυτόν τον τρόπο, το αποτέλεσμα παραμένει φυσικό και ευανάγνωστο, αλλά όσοι διαθέτουν το σχετικό κλειδί μπορούν να ελέγξουν αν η ακολουθία επιλογών ταιριάζει με εκείνη που θα παρήγαγε το Claude. Το σύστημα, λοιπόν, δεν αποδεικνύει με βεβαιότητα την προέλευση, αλλά επιτρέπει την εκτίμηση πιθανότητας.
Επηρεάζεται η ποιότητα του παραγόμενου κειμένου;
Η Anthropic υποστηρίζει ότι η ποιότητα του κειμένου δεν επηρεάζεται. Όπως αναφέρει, σε εσωτερικές δοκιμές δεν παρατηρήθηκε διαφορά στο περιεχόμενο, στη δημιουργικότητα ή στην αναγνωσιμότητα των απαντήσεων. Η εταιρεία παραπέμπει επίσης στη μέθοδο SynthID-Text, πάνω στην οποία βασίζεται η δική της υλοποίηση, και η οποία είχε παρουσιαστεί από την Google DeepMind. Σε εκείνη την έρευνα, οι αξιολογήσεις χρηστών και οι ελεγχόμενες συγκρίσεις δεν έδειξαν στατιστικά σημαντικές αποκλίσεις ανάμεσα σε υδατογραφημένες και μη υδατογραφημένες απαντήσεις.
Η αναλογία που χρησιμοποιεί η Anthropic είναι αποκαλυπτική. Παρομοιάζει την τυχαιότητα των επιλογών λέξεων με μια παρτίδα επιτραπέζιου παιχνιδιού, όπου οι κινήσεις παραμένουν τυχαίες είτε προκύπτουν από ζάρι είτε από μια προκαθορισμένη ακολουθία αριθμών. Για τους παίκτες, η εμπειρία δεν αλλάζει, όμως ένας παρατηρητής που γνωρίζει την ακολουθία μπορεί αργότερα να ελέγξει αν αυτή χρησιμοποιήθηκε. Με τον ίδιο τρόπο, το υδατογράφημα δεν αλλάζει την εμπειρία ανάγνωσης, αλλά επιτρέπει εκ των υστέρων έναν τεχνικό έλεγχο πιθανής προέλευσης.
Περιορισμοί και σημεία όπου η ανίχνευση δυσκολεύει
Παρά τις διαβεβαιώσεις, η Anthropic αναγνωρίζει σαφώς ότι η τεχνολογία έχει όρια. Το υδατογράφημα δεν μπορεί να απαντήσει αν ένα κείμενο γράφτηκε από άνθρωπο, ούτε να δείξει αν προήλθε από άλλο σύστημα τεχνητής νοημοσύνης. Αν ένας άλλος πάροχος χρησιμοποιεί παρόμοια τεχνική, θα βασίζεται σε διαφορετικό κλειδί ή ακόμη και σε διαφορετική μέθοδο. Επομένως, η ανίχνευση απαντά μόνο στο ερώτημα αν είναι πιθανό να συμμετείχε το Claude.
Η αποτελεσματικότητα μειώνεται επίσης σε μικρά αποσπάσματα κειμένου, όπου υπάρχουν λιγότερες γλωσσικές επιλογές για ανάλυση. Το ίδιο ισχύει και σε περιπτώσεις πολύ αυστηρών ή πραγματολογικών διατυπώσεων, όπου υπάρχει μία μόνο σωστή συνέχεια. Η εταιρεία αναφέρει ως παράδειγμα προτάσεις με ακριβείς ιστορικές ή μαθηματικές απαντήσεις, όπου δεν υπάρχει περιθώριο εναλλακτικών. Σε τέτοια σημεία, το υδατογράφημα ουσιαστικά δεν έχει χώρο να δράσει.
Τι ισχύει για επιμέλεια, μετάφραση και κώδικα
Η ανακοίνωση έχει ιδιαίτερο ενδιαφέρον για τις περιπτώσεις όπου το Claude δεν γράφει από το μηδέν, αλλά επεξεργάζεται ανθρώπινο κείμενο. Αν το μοντέλο περιοριστεί σε ελαφριά διόρθωση γραμματικής ή στίξης, το υδατογράφημα μπορεί να εμφανίζεται μόνο στις λίγες παρεμβάσεις που έκανε. Αυτό σημαίνει ότι η συμμετοχή του ίσως να μην είναι ανιχνεύσιμη, ειδικά όταν το αρχικό κείμενο παραμένει σχεδόν αμετάβλητο. Όσο περισσότερες λέξεις επιλέγει το ίδιο το Claude, τόσο αυξάνεται και η δυνατότητα σήμανσης.
Στις μεταφράσεις, αντίθετα, η Anthropic αναφέρει ότι το υδατογράφημα εφαρμόζεται κανονικά, επειδή κάθε λέξη επιλέγεται από το μοντέλο. Στον κώδικα, η εικόνα είναι διαφορετική, καθώς πολλά τμήματα απαιτούν απολύτως ακριβή αποτελέσματα και δεν επιτρέπουν ισοδύναμες εναλλακτικές. Εκεί η σήμανση είναι γενικά πιο περιορισμένη και αφορά κυρίως σημεία όπου υπάρχει πραγματική ευελιξία, όπως ορισμένα σχόλια μέσα στον κώδικα. Η Anthropic εκτιμά ότι η επίδραση στον ίδιο τον παραγόμενο κώδικα θα είναι αμελητέα.
Κόστος, ιδιωτικότητα και συμμόρφωση με την ΕΕ
Ένα από τα πρακτικά ερωτήματα αφορά την απόδοση και το κόστος. Η εταιρεία υποστηρίζει ότι το υδατογράφημα δεν παράγει επιπλέον tokens και δεν αυξάνει την τιμή χρήσης ή εξυπηρέτησης του μοντέλου. Αναφέρει επίσης ότι η επίπτωση στην ταχύτητα είναι αμελητέα. Με άλλα λόγια, η αλλαγή παρουσιάζεται ως κανονιστική και τεχνική προσαρμογή, όχι ως νέα λειτουργία που επηρεάζει τη χρέωση ή την εμπειρία χρήσης.
Στο πεδίο της ιδιωτικότητας, η Anthropic είναι κατηγορηματική ότι δεν ενσωματώνονται δεδομένα χρήστη στο υδατογράφημα. Δεν υπάρχει, σύμφωνα με την περιγραφή της, τρόπος ανάκτησης πληροφοριών για άτομο, οργανισμό ή περιεχόμενο συνομιλιών μέσω του κλειδιού. Η υιοθέτηση της λύσης αποδίδεται στην ανάγκη συμμόρφωσης με το EU AI Act και τον σχετικό Κώδικα Πρακτικής για τη διαφάνεια περιεχομένου που παράγεται από AI. Η εταιρεία σημειώνει ακόμη ότι εργάζεται και για την προσθήκη σήμανσης σε παλαιότερα μοντέλα Claude που καλύπτονται από μεταβατική περίοδο.
Τι έρχεται στη συνέχεια
Η Anthropic αναφέρει ότι σύντομα θα διαθέσει API για την ανίχνευση του υδατογραφήματος, χωρίς ακόμη να έχει παρουσιάσει όλες τις λεπτομέρειες υλοποίησης. Αυτό είναι σημαντικό, επειδή η ύπαρξη σήμανσης αποκτά πρακτική αξία μόνο όταν υπάρχουν εργαλεία ελέγχου για επιχειρήσεις, πλατφόρμες και οργανισμούς. Παράλληλα, η εταιρεία διευκρινίζει ότι η ανίχνευση δεν ταυτίζεται με τα κλασικά εργαλεία ανίχνευσης AI της αγοράς, τα οποία προσπαθούν να εντοπίσουν μηχανικά χαρακτηριστικά γραφής χωρίς να έχουν πρόσβαση σε εσωτερικό κλειδί. Η προσέγγιση του υδατογραφήματος είναι, επομένως, διαφορετική από τα συστήματα που αναλύουν ύφος και γλωσσικά μοτίβα.
Για εικόνες και άλλα αρχεία, η εταιρεία δεν μιλά για υδατογράφημα αλλά για content credentials μέσω του προτύπου C2PA. Σε υποστηριζόμενα αρχεία, όπως .png, .jpg και .svg, το Claude θα προσθέτει μια κρυπτογραφικά υπογεγραμμένη σημείωση στα μεταδεδομένα που δηλώνει ότι το αρχείο δημιουργήθηκε ή επεξεργάστηκε με τη βοήθειά του. Η Anthropic επισημαίνει ότι αυτό δεν αλλάζει το ίδιο το περιεχόμενο του αρχείου και, όπως και στο κείμενο, δεν αποκαλύπτει στοιχεία ταυτότητας. Το συνολικό μήνυμα είναι σαφές: η αγορά μπαίνει σταδιακά σε μια φάση όπου η ιχνηλασιμότητα περιεχομένου AI θα αποτελεί πλέον δομικό μέρος των υπηρεσιών.













