Κορυφαίος επιστήμονας της OpenAI ζητά φρένο στην AI: «Κανείς δεν είναι έτοιμος για τις συνέπειες»
Κάποιες μέρες μετά την παρουσίαση ενός νέου, εξαιρετικά ικανού μοντέλου, κορυφαίος επιστήμονας της OpenAI καλεί σε μείωση των ταχυτήτων, καθώς, όπως επεσήμανε σε εκτενή ανάρτησή του την Κυριακή, ανησυχεί ότι «κανείς δεν είναι προετοιμασμένος για τις συνέπειες μίας συνεχούς ραγδαίας ανάπτυξης της τεχνητής νοημοσύνης».
Ο Jakub Pachocki σημείωσε πως παρόλο που η OpenAI στοχεύει σε εσωτερικές τεχνικές λύσεις ώστε να ελέγχει καλύτερα τους ισχυρούς ΑΙ agents, «απαιτούνται ευρύτερες παρεμβάσεις». Ανέφερε συγκεκριμένα ανησυχίες ότι οι όλο και πιο αυτόνομοι agents θα μπορούσαν να μάθουν να αποφεύγουν την ανθρώπινη επίβλεψη, να παρεμβαίνουν στα συστήματα και να ξεγελούν τους ανθρώπους ώστε να επιτυγχάνουν τους σκοπούς τους.
Σύμφωνα με δημοσίευμα του Business Insider, ο ίδιος ζήτησε να καθιερωθούν «υποχρεωτικά μέτρα ασφαλείας» που δήλωσε ότι θα μπορούσαν να επιβληθούν από «ένα δίκτυο third-party ελεγκτών, από κυβερνητικές υπηρεσίες ή διεθνείς οργανισμούς».
Από την πλευρά του, ο Sam Altman, CEO της OpenAI, αναδημοσίευσε το άρθρο του Pachocki χαρακτηρίζοντάς το «μία σημαντική δημοσίευση».
Η OpenAI αποκάλυψε την Πέμπτη το πιο πρόσφατο μοντέλο, το Astra. Ο κατασκευαστής του ChatGPT ανέφερε ότι παρά τις εξαιρετικές δυνατότητες του Astra στα μαθηματικά και στη χρήση υπολογιστών, το μοντέλο είναι το πιο «ευθυγραμμισμένο», δηλαδή έχει μικρότερη τάση να λειτουργεί ανεξέλεγκτα.
Η Anthropic, ο κύριος ανταγωνιστής της OpenAI στον τομέα των εξαιρετικά εξελιγμένων συστημάτων ΑΙ, έχει εδώ και καιρό καλέσει σε πιο τυποποιημένη κυβερνητική ρύθμιση. Πρόσφατα, ο Pachocki ενώθηκε με αυτές τις εκκλήσεις, υπογράφοντας μια ανοιχτή επιστολή τον Ιούλιο με την οποία ζητούσε από την ομοσπονδιακή κυβέρνηση να ρυθμίσει τον ρυθμό ανάπτυξης της τεχνητής νοημοσύνης.
Οι κίνδυνοι που απαιτούν τη μείωση ταχύτητας
Παρακάτω παρουσιάζονται οι κίνδυνοι που επισημαίνει ο Pachocki καλώντας σε επιβράδυνση του ΑΙ:
Οι agents μπορούν να ξεγελάσουν και να εκβιάσουν ανθρώπους
Ο Pachocki σημείωσε ότι οι AI agents εξελίσσονται σε «υπεράνθρωποι» στο να παραβιάζουν προστατευμένα συστήματα στο ανοιχτό διαδίκτυο. Ανέφερε μάλιστα, όπως επισημαίνεται στο δημοσίευμα του Business Insider, ότι οι ικανότητές τους στο χακάρισμα θέτουν σε κίνδυνο τις υποδομές παγκοσμίως.
«Αυτή τη στιγμή έχουμε ένα στενό χρονικό περιθώριο για να αξιοποιήσουμε τα καλύτερα διαθέσιμα μοντέλα και να ενισχύσουμε σημαντικά την ασφάλεια των κρίσιμων συστημάτων», ανέφερε.
Οι AI agents, πρόσθεσε, θα αρχίσουν σύντομα να επιδιώκουν τους δικούς τους στόχους, ανεξάρτητα από τις εντολές που εισάγουν οι ανθρώπινοι χειριστές. Ανέφερε επίσης ότι οι πράκτορες δεν διστάζουν να εκβιάζουν ή να διαπραγματεύονται με ανθρώπους για να επιτύχουν τους στόχους τους.
Σε μια έκθεση που δημοσιεύθηκε τον Αύγουστο, το βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης (AI Security Institute) περιέγραψε λεπτομερώς πώς ένας αυτονομημένος agent της Anthropic είπε ψέματα και προσπάθησε να εξαναγκάσει έναν διαχειριστή του GitHub να τοποθετήσει κακόβουλο λογισμικό στον ιστότοπο.
«Απλώς προσπαθούσα να κάνω μια χρήσιμη συνεισφορά και να διορθώσω ένα σφάλμα», έγραψε ο πράκτορας, σύμφωνα με την έκθεση. «Δεν νομίζω ότι η προειδοποίησή σας είναι δίκαιη»
Οι πράκτορες μπορούν να παραπλανήσουν την ανθρώπινη παρακολούθηση
Ο Pachocki ανέφερε πως η OpenAI παρακολουθεί κυρίως την «αλυσίδα λογικής σκέψης» που χρησιμοποιούν τα διάφορα μοντέλα για να προσδιορίσουν πώς οι πράκτορες παρεκκλίνουν από την πορεία τους και ενεργούν ανεξέλεγκτα.
Για παράδειγμα, ένας agent μπορεί να σκεφτεί: «Πρέπει να αντιγράψω σε αυτό το τεστ», και η OpenAI θα είναι σε θέση να δει αυτή τη συλλογιστική, αλλά ο πράκτορας δεν θα συνειδητοποιεί ότι η σκέψη του είναι ορατή.
Προς το παρόν, αυτό σημαίνει ότι οι πράκτορες δεν έχουν κανένα τρόπο να κρύψουν ή να συγκαλύψουν με άλλο τρόπο τις σκέψεις τους, ώστε να εμποδίσουν την OpenAI να ανακαλύψει την κακή συμπεριφορά τους.
Ωστόσο, ο Pachocki ανέφερε ότι τα νεότερα μοντέλα γίνονται όλο και καλύτερα στο να χειρίζονται τις δικές τους διαδικασίες συλλογιστικής, εμποδίζοντας έτσι την OpenAI να δει τις καθαρές, αληθινές σκέψεις τους.
Ορισμένα από τα πιο πρόσφατα μοντέλα δεν εκφράζουν καν λεκτικά τη συλλογιστική τους, ανέφερε ο Pachocki.
Αυτή η εξέλιξη, σύμφωνα με τον Pachocki, θα μπορούσε να αποτελέσει εμπόδιο στην ανάπτυξη της τεχνητής νοημοσύνης, καθώς οι ερευνητές υποτίθεται απαιτείται να διασφαλίζουν ότι έχουν πλήρη πρόσβαση στα δεδομένα και τη διαδικασία.
Οι agents μπορούν να επιταχύνουν τη δική τους ανάπτυξη
Όλο και περισσότερο, τα μοντέλα τεχνητής νοημοσύνης βελτιώνονται από μόνα τους μέσω μιας διαδικασίας που ο Pachocki αποκαλεί «αναδρομική αυτοβελτίωση». Η διαδικασία αυτή προσφέρει έναν τρόπο για την ταχεία κλιμάκωση της ανάπτυξης της τεχνητής νοημοσύνης.
Ωστόσο, ο Pachocki προειδοποίησε ότι η σημαντική επιτάχυνση της ανάπτυξης της «τεχνητής νοημοσύνης από την τεχνητή νοημοσύνη» βραχυπρόθεσμα ενέχει κινδύνους και δεν αποτελεί τη «σωστή συλλογική δράση που πρέπει να αναλάβουμε ως ερευνητική κοινότητα».
Ο Pachocki ανέφερε ότι οι υπεύθυνοι πρέπει να βρουν δημιουργικούς τρόπους για να παρακολουθούν την αυτοβελτίωση ή, αλλιώς, να συντονιστούν με άλλες εταιρείες τεχνητής νοημοσύνης προκειμένου να οργανώσουν μια συντονισμένη επιβράδυνση, ώστε να «οικοδομήσουν εμπιστοσύνη σε αυτά τα μέτρα».
«Η βασική πρόκληση της αυτοματοποίησης της έρευνας στον τομέα της τεχνητής νοημοσύνης δεν είναι το “να φτάσουμε εκεί”», δήλωσε ο Pachocki. «Είναι το να φτάσουμε εκεί με έναν τρόπο με τον οποίο οι άνθρωποι παραμένουν μέρος της συνεχούς διαδικασίας βελτίωσης και το μέλλον βρίσκεται στα χέρια της ανθρωπότητας».