Η αόρατη «υπογραφή» του ChatGPT: Τι αλλάζει στα κείμενα που παράγει η τεχνητή νοημοσύνη
Η OpenAI ανακοίνωσε πως θα αρχίσει να «σημαδεύει» τα κείμενα που δημιουργούνται από το ChatGPT και το Codex στην Ευρωπαϊκή Ένωση, προκειμένου να συμμορφωθεί με τον ευρωπαϊκό Κανονισμό για την Τεχνητή Νοημοσύνη (AI Act).
Οι κανόνες διαφάνειας του AI Act, που ισχύουν από τις 2 Αυγούστου, απαιτούν από τις εταιρείες AI να επισημαίνουν το περιεχόμενο που παράγεται μέσω Τεχνητής Νοημοσύνης με τρόπο που άλλα συστήματα μπορούν να αναγνωρίσουν, όπως αναφέρει δημοσίευμα του techcrunch. Στο πλαίσιο αυτό, η OpenAI ανακοίνωσε ότι το αόρατο υδατογράφημα θα αρχίσει να ενσωματώνεται τις επόμενες εβδομάδες στο περιεχόμενο που παράγει για τους χρήστες του ChatGPT και του Codex, μόνο στην Ευρωπαίκή Ένωση. Οι προγραμματιστές που χρησιμοποιούν API της OpenAI οπουδήποτε στον κόσμο μπορούν να ενεργοποιήσουν τη λειτουργία αυτή, καθώς η εταιρεία δήλωσε ότι δεν θα είναι προεπιλεγμένη παγκοσμίως κατά το λανσάρισμα.
Έτσι, η OpenAI ακολουθεί έναν δρόμο που είχε ήδη ανοίξει ο ανταγωνισμός. Δύο μήνες νωρίτερα η Anthropic είχε ανακοινώσει υδατογράφημα στα κείμενα του Claude, και μάλιστα παγκοσμίως και όχι μόνο στην Ευρώπη. Οι δύο αυτές εταιρείες, μαζί με την Google, τη Meta και τη Microsoft περιλαμβάνονται στις εταιρείες που υπογράφουν τον ευρωπαϊκό κώδικα πρακτικής για το περιεχόμενο που παράγεται από την Τεχνητή Νοημοσύνη.
Πώς λειτουργεί η αόρατη «υπογραφή»
Όπως έχει γίνει γνωστό, δεν πρόκειται για κάποιο κρυφό σύμβολο ή έναν αόρατο χαρακτήρα που κάποιος μπορεί να σβήσει με ένα κλικ. Το υδατογράφημα βρίσκεται μέσα στο ίδιο το κείμενο, στις ίδιες τις λέξεις, καθώς το κάθε μοντέλο διαλέγει την επόμενη λέξη με έναν τρόπο που έχει ως αποτέλεσμα τη δημιουργία ενός συγκεκριμένου μοτίβου. Έτσι, όταν το κείμενο αντιγράφεται, το μοτίβο εξακολουθεί να υπάρχει και μεταφέρεται με τις λέξεις, χωρίς να το αντιλαμβάνεται ο αναγνώστης, αλλά ένα εργαλείο ανίχνευσης μπορεί να το εντοπίσει.
Η μέθοδος ονομάζεται textGrain και η OpenAI δημοσίευσε σχετική τεχνική αναφορά, σε συνεργασία με ερευνητές από το Πανεπιστήμιο της Πενσυλβάνια και το Γέιλ, αναφέρει το άρθρο του techcrunch. Καθώς η «υπογραφή» υπάρχει μέσα στις λέξεις, ακολουθεί το κείμενο όπου κι αν πάει, ακόμη και με αντιγραφή και επικόλληση. Η εταιρεία διευκρινίζει επίσης ότι το υδατογράφημα δεν ταυτοποιεί τον χρήστη και ότι δεν είδε ουσιαστική αλλαγή στην απόδοση των μοντέλων της.
Πού θα εφαρμοστεί
- Χρήστες ChatGPT και Codex στην ΕΕ: η εφαρμογή θα γίνει σταδιακά τις επόμενες εβδομάδες, σε όλα τα πακέτα συνδρομής.
- Προγραμματιστές με το API της OpenAI, οπουδήποτε στον κόσμο: μπορούν να ενεργοποιήσουν το υδατογράφημα για επιλεγμένα μοντέλα από σήμερα. Είναι απενεργοποιημένο από προεπιλογή.
- Παγκόσμια εφαρμογή: προς το παρόν δεν υπάρχει. Η OpenAI δεν το κάνει προεπιλογή εκτός ΕΕ.
Τα όρια και οι αδυναμίες
Η εταιρεία υποστηρίζει βέβαια ότι υπάρχει η δυνατότητα να «χαθεί» το υδατογράφημα, σε περίπτωση που το κείμενο υποστεί επεξεργασία. Και όσο περισσότερες αλλαγές και τροποποιήσεις γίνουν σε ένα κείμενο, τόσο πιο δύσκολο θα είναι να εντοπιστεί από το εργαλείο ανίχνευσης. Σε δοκιμή της OpenAI, αν αντικατασταθεί το 10% των λέξεων με συνώνυμα, η ανίχνευση πέφτει από περίπου από το 92% στο 66%. Επιπλέον, παρουσιάζεται δυσκολία να εντοπιστούν:
- τα σύντομα κείμενα,
- οι απαντήσεις σε μαθηματικά προβλήματα,
- τα μεταφρασμένα κείμενα.
Γι' αυτό η OpenAI δίνει προς το παρόν πρόσβαση στον ανιχνευτή μόνο σε εγκεκριμένους ερευνητές και εξειδικευμένους οργανισμούς, ώστε να αξιολογηθεί η αξιοπιστία και η υπεύθυνη χρήση του. Δεν μπορεί λοιπόν ο καθένας να «ελέγξει» ένα κείμενο.
Πόσο επηρεάζει η ανθρώπινη παρέμβαση
Με τη συζήτηση σχετικά με τη διαφάνεια και την αξιοπιστία να εντείνεται, ένα από τα πιο σημαντικά σημεία που αναδεικνύει η OpenAI στην ανακοίνωσή της είναι πως ένα κείμενο που δεν έχει υδατογράφημα δεν σημαίνει απαραίτητα ότι έχει δημιουργηθεί από άνθρωπο. Η εταιρεία προειδοποιεί πως μπορεί να μην υπάρχει υδατογράφημα σε κείμενα πολύ μικρά, ή αν έχει γίνει εκτενής επεξεργασία ή αν έχει δημιουργηθεί από μοντέλο άλλης εταιρείας.
Αντίστροφα, η παρουσία του δείχνει ότι ένα σύστημα της OpenAI παρήγαγε ή επεξεργάστηκε μέρος του κειμένου. Ωστόσο, δεν δείχνει πόση ανθρώπινη παρέμβαση, επιμέλεια ή δημιουργικότητα προστέθηκε.
Το ζήτημα της «ευθύνης»
Η αντίστοιχη ανακοίνωση της Anthropic τον Αύγουστο προκάλεσε αντιδράσεις από χρήστες. Υποστήριζαν ότι αυτοί έδιναν τις οδηγίες, το πλαίσιο και τις αποφάσεις, ενώ το εργαλείο απλώς εκτελούσε. Η συζήτηση αυτή θα ενταθεί τώρα που το ChatGPT ακολουθεί, αφού επηρεάζει φοιτητές, επαγγελματίες και δημιουργούς περιεχομένου. Θα έχει σημασία και ο ρόλος του ανταγωνισμού.
Σύμφωνα με δημοσίευμα της Wall Street Journal το 2024, η OpenAI είχε φτιάξει παλαιότερα ένα εργαλείο υδατογράφησης αλλά το κράτησε στο συρτάρι, εν μέρει από φόβο ότι οι χρήστες θα μετακινηθούν σε ανταγωνιστές χωρίς υδατογράφημα. Η ευρωπαϊκή νομοθεσία αλλάζει αυτή την εξίσωση τουλάχιστον για την ΕΕ.