Το Claude θα αφήνει «αόρατο αποτύπωμα» στα κείμενά του - Τι αλλάζει στην AI

ΠΟΛΙΤΗΣ NEWS

Header Image

Η Anthropic εισάγει ψηφιακό «υδατογράφημα» στα κείμενα που δημιουργεί το Claude, ώστε να μπορεί να ανιχνεύεται η εμπλοκή της τεχνητής νοημοσύνης. Η αλλαγή γίνεται στο πλαίσιο των νέων κανόνων της ΕΕ και έχει ήδη ανοίξει συζήτηση για το εάν θα επηρεάσει την ποιότητα της γραφής.

Ένα αόρατο «δακτυλικό αποτύπωμα» θα αρχίσουν να αφήνουν σταδιακά πίσω τους τα κείμενα που δημιουργεί το Claude. Η Anthropic αλλάζει τον τρόπο με τον οποίο το μοντέλο τεχνητής νοημοσύνης επιλέγει τις λέξεις του, δημιουργώντας ένα στατιστικό μοτίβο που ο αναγνώστης δεν θα μπορεί να αντιληφθεί, αλλά θα επιτρέπει να διαπιστωθεί εάν το AI συμμετείχε στη συγγραφή ενός κειμένου.

Την αλλαγή ανακοίνωσε επισήμως η Anthropic, εξηγώντας ότι τα μελλοντικά μοντέλα Claude θα ενσωματώνουν σύστημα υδατογράφησης κειμένου, στο πλαίσιο της συμμόρφωσης της εταιρείας με τον ευρωπαϊκό AI Act.

Όπως επισημαίνει σε σχετικό δημοσίευμά της η Guardian, η κίνηση έχει ήδη προκαλέσει συζήτηση στον τεχνολογικό κόσμο για το κατά πόσον ένας τέτοιος μηχανισμός θα μπορούσε να περιορίσει τις γλωσσικές επιλογές ενός chatbot και τελικά να επηρεάσει την ποιότητα των κειμένων που παράγει.

Πώς θα λειτουργεί το «αόρατο» σημάδι

Το σύστημα δεν θα προσθέτει κάποιο ορατό σύμβολο, ένδειξη ή κρυφό χαρακτήρα στο κείμενο. Αντίθετα, θα λειτουργεί στο ίδιο το στάδιο κατά το οποίο το μοντέλο επιλέγει ποια λέξη θα γράψει στη συνέχεια.

Τα μεγάλα γλωσσικά μοντέλα έχουν συχνά περισσότερες από μία αποδεκτές επιλογές για τη συνέχεια μιας πρότασης. Για παράδειγμα, μπορεί να επιλέξουν μεταξύ δύο λέξεων με σχεδόν ίδια σημασία. Σε τέτοιες περιπτώσεις υπάρχει ήδη ένα στοιχείο τυχαιότητας στην επιλογή.

Με την υδατογράφηση, η πηγή αυτής της τυχαιότητας αλλάζει. Οι επιλογές εξακολουθούν να φαίνονται τυχαίες στον χρήστη, ωστόσο σχηματίζουν ένα συγκεκριμένο στατιστικό μοτίβο. Όποιος διαθέτει το κατάλληλο «κλειδί» μπορεί στη συνέχεια να εξετάσει το κείμενο και να υπολογίσει την πιθανότητα να έχει δημιουργηθεί ή υποστεί επεξεργασία από το Claude.

Η τεχνική που επέλεξε η Anthropic βασίζεται στο SynthID-Text, μέθοδο που είχε παρουσιάσει η Google DeepMind.

Θα γράφει χειρότερα το Claude;

Αυτό είναι το ερώτημα που έχει προκαλέσει τη μεγαλύτερη συζήτηση.

Ο βετεράνος τεχνολογικός αρθρογράφος John Gruber υποστήριξε ότι η υδατογράφηση περιορίζει, έστω και σε μικρό βαθμό, την ελευθερία του μοντέλου να επιλέγει την επόμενη λέξη και συνεπώς μπορεί να το οδηγήσει σε λιγότερο ακριβείς ή κομψές γλωσσικές επιλογές, όπως αναφέρει η Guardian.

Η Anthropic απορρίπτει αυτή την εκτίμηση. Σύμφωνα με την εταιρεία, οι εσωτερικές δοκιμές δεν έδειξαν καμία πρακτικά αντιληπτή επίδραση στο περιεχόμενο, στη δημιουργικότητα ή στην αναγνωσιμότητα των απαντήσεων. Η εταιρεία υποστηρίζει ότι για τον αναγνώστη ένα υδατογραφημένο κείμενο θα είναι ουσιαστικά αδύνατο να διακριθεί από ένα μη υδατογραφημένο.

Παρόμοια άποψη εξέφρασε στη Guardian ο Steven Murdoch, καθηγητής Πληροφορικής στο University College London, εκτιμώντας ότι η αλλαγή πιθανότατα δεν θα έχει αισθητή επίδραση στην ποιότητα του κειμένου, καθώς το στοιχείο της τυχαιότητας υπάρχει ήδη στον τρόπο λειτουργίας των μεγάλων γλωσσικών μοντέλων.

Οι νέοι κανόνες της Ευρωπαϊκής Ένωσης

Η αλλαγή συνδέεται άμεσα με τις απαιτήσεις διαφάνειας του AI Act της Ευρωπαϊκής Ένωσης. Το άρθρο 50 προβλέπει ότι οι πάροχοι συστημάτων παραγωγικής τεχνητής νοημοσύνης πρέπει να λαμβάνουν μέτρα ώστε το περιεχόμενο που παράγεται ή τροποποιείται από AI να μπορεί να ανιχνεύεται σε μηχανικά αναγνώσιμη μορφή. Οι σχετικές υποχρεώσεις τέθηκαν σε εφαρμογή στις 2 Αυγούστου 2026.

Για παλαιότερα μοντέλα προβλέπεται μεταβατική περίοδος και η Anthropic αναφέρει ότι θα προσθέσει την τεχνολογία και σε αυτά μέσα στους επόμενους μήνες. Η εταιρεία έχει επίσης δηλώσει ότι, κατά την έναρξη εφαρμογής του συστήματος, σκοπεύει να χρησιμοποιεί την υδατογράφηση παγκοσμίως και όχι μόνο στην Ευρωπαϊκή Ένωση.

Θα μπορεί κάποιος να ελέγξει ένα κείμενο;

Η Anthropic αναφέρει ότι ετοιμάζει API ανίχνευσης, μέσω του οποίου θα μπορεί να υπολογίζεται κατά πόσον το Claude συμμετείχε στη δημιουργία ενός κειμένου. Το υδατογράφημα, ωστόσο, δεν θα αποκαλύπτει ποιος χρήστης χρησιμοποίησε το chatbot, ούτε τον οργανισμό στον οποίο ανήκει, ούτε τη συγκεκριμένη συνομιλία από την οποία προήλθε το περιεχόμενο.

Επίσης, δεν θα αποτελεί απόλυτη απόδειξη ότι «το Claude έγραψε το κείμενο». Θα μπορεί μόνο να δείχνει ότι το μοντέλο πιθανότατα συμμετείχε κάποια στιγμή στη δημιουργία ή στην εκτενή επεξεργασία του. Η Anthropic αναγνωρίζει ακόμη ότι μια πλήρης αναδιατύπωση μπορεί να καταστρέψει το υδατογράφημα, ενώ μικρότερες αλλαγές πιθανότατα δεν θα αρκούν για να το εξαφανίσουν.

Από τις εργασίες φοιτητών στο «model collapse»

Η δυνατότητα αναγνώρισης κειμένων που έχουν δημιουργηθεί από AI θα μπορούσε να αποκτήσει ιδιαίτερη σημασία στην εκπαίδευση, στις επιστημονικές δημοσιεύσεις και σε επαγγελματικούς χώρους όπου κάποιος μπορεί να παρουσιάζει περιεχόμενο chatbot ως δικό του, σημειώνει η Guardian.

Υπάρχει όμως και μία δεύτερη διάσταση. Ο Murdoch επισημαίνει ότι όσο αυξάνεται το περιεχόμενο που δημιουργείται από τεχνητή νοημοσύνη στο διαδίκτυο, τόσο μεγαλώνει ο κίνδυνος τα επόμενα μοντέλα να εκπαιδεύονται πάνω σε κείμενα που έχουν παραχθεί από άλλα μοντέλα. Η διαδικασία αυτή συνδέεται με το λεγόμενο «model collapse», κατά το οποίο η ποιότητα και η αξιοπιστία των μοντέλων μπορεί σταδιακά να υποβαθμιστούν.

Το «αόρατο αποτύπωμα» στα κείμενα της τεχνητής νοημοσύνης μπορεί επομένως να εξελιχθεί σε ένα σημαντικό εργαλείο όχι μόνο για τη διαφάνεια και την αντιμετώπιση της παραπληροφόρησης, αλλά και για να γνωρίζουν οι ίδιες οι εταιρείες AI ποιο μέρος του τεράστιου όγκου κειμένου στο διαδίκτυο έχει ήδη δημιουργηθεί από μηχανές.

ΤΑ ΑΚΙΝΗΤΑ ΤΗΣ ΕΒΔΟΜΑΔΑΣ

Λογότυπο Altamira

Πολιτική Δημοσίευσης Σχολίων

Οι ιδιοκτήτες της ιστοσελίδας www.politis.com.cy διατηρούν το δικαίωμα να αφαιρούν σχόλια αναγνωστών, δυσφημιστικού και/ή υβριστικού περιεχομένου, ή/και σχόλια που μπορούν να εκληφθεί ότι υποκινούν το μίσος/τον ρατσισμό ή που παραβιάζουν οποιαδήποτε άλλη νομοθεσία. Οι συντάκτες των σχολίων αυτών ευθύνονται προσωπικά για την δημοσίευση τους. Αν κάποιος αναγνώστης/συντάκτης σχολίου, το οποίο αφαιρείται, θεωρεί ότι έχει στοιχεία που αποδεικνύουν το αληθές του περιεχομένου του, μπορεί να τα αποστείλει στην διεύθυνση της ιστοσελίδας για να διερευνηθούν. Προτρέπουμε τους αναγνώστες μας να κάνουν report / flag σχόλια που πιστεύουν ότι παραβιάζουν τους πιο πάνω κανόνες. Σχόλια που περιέχουν URL / links σε οποιαδήποτε σελίδα, δεν δημοσιεύονται αυτόματα.

Διαβάστε περισσότερα