Θα μιλάμε στα ρομπότ και θα εκτελούν τις εντολές μας από το 2027;
Τα ανθρωποειδή μοντέλα πλησιάζουν με ταχείς ρυθμούς τις ικανότητες του «Chatgpt», καθώς η SpiritAI αναπτύσσει μοντέλα που μετατρέπουν το λόγο σε φυσικές ενέργειες.
Σύμφωνα με δημοσίευμα του Reuters, η δυνατότητα να ζητάμε από ένα ρομπότ να εκτελέσει μια εργασία χρησιμοποιώντας απλώς την ομιλία μας ενδέχεται να περάσει από την σφαίρα της επιστημονικής φαντασίας στην πραγματικότητα ήδη από το 2027.
Όπως αναφέρει ο επικεφαλής της SpiritAI, μια από τις κορυφαίες κινεζικές εταιρείες που αναπτύσσουν τους λεγόμενους «εγκεφάλους» των ρομπότ, σύντομα εκείνα θα μπορούν να ακούν μια προφορική οδηγία, να την κατανοούν και στη συνέχεια να πραγματοποιούν μόνα τους μια σειρά από λογικές κινήσεις προκειμένου να ολοκληρώσουν την αποστολή τους και όλα αυτά μονάχα με μια φωνητική εντολή.
«Θα μπορείτε να μιλήσετε σε ένα ρομπότ στη φυσική γλώσσα και εκείνο θα εκτελεί μια σειρά από εύλογες φυσικές ενέργειες, προσπαθώντας να ολοκληρώσει την εργασία», δήλωσε στο Reuters ο Γκάο Γιανγκ, συνιδρυτής και επικεφαλής επιστήμονας της κινεζικής Spirit AI.
Η εταιρεία αναμένει ότι έως τα μέσα του 2027 θα έχει φτάσει σε ένα τεχνολογικό ορόσημο αντίστοιχο με εκείνο του GPT-3.0. Αυτό δεν σημαίνει ότι τα ανθρωποειδή ρομπότ θα είναι έτοιμα να αναλάβουν άμεσα όλες τις δουλειές ενός σπιτιού. Η χρήση τους στη βιομηχανία και σε επιχειρήσεις αναμένεται να προηγηθεί, καθώς το οικιακό περιβάλλον θεωρείται πολύ πιο σύνθετο και απρόβλεπτο.
«Ο εγκέφαλος αποτελεί πράγματι τον πιο αδύναμο κρίκο σε ολόκληρη την αλυσίδα της ρομποτικής»
Οι κινεζικές εταιρείες έχουν σημειώσει εντυπωσιακή πρόοδο στο υλικό των ανθρωποειδών ρομπότ, τα οποία μπορούν πλέον να τρέχουν με μεγάλη ταχύτητα, να χορεύουν και να κάνουν ακόμη και ανάποδες περιστροφές κατόπιν εντολής, όπως είδαμε και στην Ολυμπιάδα των ρομπότ στο Πεκίνο τον Αύγουστο. Το μεγάλο εμπόδιο, ωστόσο, παραμένει το λογισμικό που καθορίζει την ευφυΐα τους και τους επιτρέπει να εκτελούν πραγματικά χρήσιμες και οικονομικά παραγωγικές εργασίες.
Το συγκεκριμένο πεδίο είναι γνωστό ως «ενσώματη τεχνητή νοημοσύνη» ή embodied AI. Σε αντίθεση με ένα chatbot, το οποίο επεξεργάζεται και παράγει πληροφορίες, ένα τέτοιο σύστημα πρέπει να αντιλαμβάνεται τον φυσικό χώρο, να σχεδιάζει τις κινήσεις του και να αλληλεπιδρά με πραγματικά αντικείμενα.
«Ο εγκέφαλος αποτελεί πράγματι τον πιο αδύναμο κρίκο σε ολόκληρη την αλυσίδα της ρομποτικής», ανέφερε ο Γκάο. Ο κλάδος αναζητά πλέον τη δική του «στιγμή του ChatGPT»: μια μεγάλη ανακάλυψη στο λογισμικό που θα μετατρέψει μια πρωτοποριακή, αλλά ακόμη περιορισμένη τεχνολογία, σε προϊόν χρήσιμο για πολύ περισσότερους πελάτες.
Η κυκλοφορία του ChatGPT από την OpenAI το 2022 έφερε τη γενετική τεχνητή νοημοσύνη στο ευρύ κοινό και απέδειξε τις εμπορικές δυνατότητές της. Οι εταιρείες ρομποτικής φιλοδοξούν τώρα να προκαλέσουν αντίστοιχη ανατροπή στον φυσικό κόσμο.
Χίλιοι άνθρωποι «διδάσκουν» στα ρομπότ πώς να κινούνται
Για την εκπαίδευση των μοντέλων της, η Spirit AI απασχολεί περίπου 1.000 εξωτερικούς συνεργάτες σε ολόκληρη την Κίνα. Οι εργαζόμενοι φορούν ειδικό εξοπλισμό συλλογής δεδομένων μέσα σε σπίτια ή εργοστάσια και καταγράφουν τον τρόπο με τον οποίο οι άνθρωποι κινούνται και αλληλεπιδρούν με το περιβάλλον τους.
Σε κέντρο εκπαίδευσης της εταιρείας στο Πεκίνο, δεκάδες νέοι άνθρωποι, εξοπλισμένοι με αισθητήρες, επαναλαμβάνουν καθημερινές κινήσεις, όπως το άνοιγμα ενός ψυγείου, το ξεκλείδωμα ενός χρηματοκιβωτίου και το κόψιμο λαχανικών με μαχαίρι.
Τα ρομπότ της Spirit AI έχουν ήδη φτάσει σε ποσοστό επιτυχίας 90% όταν εκτελούν απλές εργασίες σε οργανωμένα περιβάλλοντα σαλονιού. Ωστόσο, ενέργειες που απαιτούν λεπτούς χειρισμούς, όπως το ξεβίδωμα του καπακιού ενός μπουκαλιού, εξακολουθούν να αποτελούν πρόκληση. Δυσκολίες παρουσιάζονται επίσης όταν το ρομπότ έρχεται αντιμέτωπο με μια εργασία την οποία δεν έχει συναντήσει προηγουμένως.
Σύμφωνα με τον Γκάο, ο οποίος είναι επίσης επίκουρος καθηγητής Ρομποτικής στο Πανεπιστήμιο Τσινγκχουά, η επόμενη διετία θα αποτελέσει το πρώτο πραγματικό παράθυρο για τη βιομηχανική αξιοποίηση της τεχνολογίας.
Σε περίπου δύο χρόνια αναμένεται να εμφανιστούν ρομπότ σε εμπορικές υπηρεσίες, εκτελώντας σχετικά απλές εργασίες. Η είσοδός τους στα σπίτια θα χρειαστεί περισσότερο χρόνο, επειδή εκεί καλούνται να κινηθούν σε πολύ λιγότερο ελεγχόμενες συνθήκες.
Ρομπότ στις γραμμές παραγωγής των CATL και JD.com
Η Spirit AI έχει ήδη εγκαταστήσει δεκάδες δικά της τροχοφόρα ανθρωποειδή ρομπότ Moz1 σε γραμμές παραγωγής της κατασκευάστριας μπαταριών CATL και του κινεζικού ομίλου λιανικής και ηλεκτρονικού εμπορίου JD.com. Η JD.com αποτελεί παράλληλα επενδυτή στην εταιρεία.
Η νεοφυής επιχείρηση, η οποία ιδρύθηκε το 2024 και απασχολεί περίπου 300 άτομα, έχει συγκεντρώσει χρηματοδότηση άνω των 670 εκατ. δολαρίων. Η αποτίμησή της ανέρχεται σήμερα στα 20 δισ. γουάν, δηλαδή περίπου 2,9 δισ. δολάρια, γεγονός που την καθιστά μία από τις ταχύτερα χρηματοδοτούμενες κινεζικές εταιρείες στον κλάδο της ενσώματης τεχνητής νοημοσύνης. Ο Γκάο αρνήθηκε να σχολιάσει το ενδεχόμενο εισαγωγής της στο χρηματιστήριο.
Η πρόοδος, όπως επισημαίνει, είναι εξαιρετικά γρήγορη. Όταν ιδρύθηκε η Spirit AI, ένα ρομπότ μπορούσε να εκτελεί καλά μόνο μία μεμονωμένη εργασία, όπως να ρίχνει νερό σε ένα ποτήρι ή να διπλώνει ένα ρούχο. Σήμερα, τα ρομπότ μπορούν να κινούνται σε πολύ μεγαλύτερους χώρους και να ολοκληρώνουν συνεχόμενες, σύνθετες ροές εργασίας.
Γιατί η Spirit AI προτιμά τα δεδομένα του πραγματικού κόσμου
Η εταιρεία βασίζεται κυρίως σε δεδομένα από τον πραγματικό κόσμο για να εκπαιδεύσει τα μοντέλα της, αντί να χρησιμοποιεί εικονικές προσομοιώσεις. Πολλοί ανταγωνιστές καταφεύγουν σε προσομοιωτές προκειμένου να μειώσουν το κόστος εκπαίδευσης, όμως, σύμφωνα με τον Γκάο, ορισμένες εργασίες μπορούν να διδαχθούν μόνο μέσα από την πραγματική επαφή με φυσικά αντικείμενα.
Οι προσομοιωτές αποδίδουν ικανοποιητικά όταν πρόκειται για άκαμπτα σώματα. Αντίθετα, δυσκολεύονται να αναπαραστήσουν εύκαμπτα αντικείμενα που αλλάζουν σχήμα, όπως τα ηλεκτρικά καλώδια.
Σε άλλα κέντρα εκπαίδευσης ρομπότ στην Κίνα, οι χειριστές μπορεί να χρειαστεί να επαναλάβουν μια κίνηση περισσότερες από 50 φορές για να καταγράψουν ένα μόνο «καθαρό» δείγμα με την απαιτούμενη ακρίβεια. Η Spirit AI διαπίστωσε, ωστόσο, ότι η χρήση πιο ακατέργαστων δεδομένων, τα οποία περιλαμβάνουν μεγαλύτερη ποικιλία κινήσεων και ατέλειες, βοηθά τα μοντέλα της να βελτιώνονται γρηγορότερα.
Ο κίνδυνος να βγουν τα ρομπότ εκτός ελέγχου
Οι ανησυχίες γύρω από την ασφάλεια της τεχνητής νοημοσύνης έχουν ενταθεί, καθώς αμερικανικές εταιρείες ζήτησαν τις τελευταίες ημέρες επιβράδυνση της ανάπτυξης προηγμένων γλωσσικών μοντέλων έπειτα από περιστατικά κυβερνοεπιθέσεων που ανέδειξαν τους κινδύνους των ανεξέλεγκτων AI agents.
Ο Γκάο εκτιμά ότι ο κίνδυνος ενός ρομπότ να λειτουργήσει ανεξέλεγκτα δεν αποτελεί ακόμη άμεση απειλή, επειδή τα σημερινά μοντέλα λογισμικού παραμένουν σχετικά ανώριμα. Το ζήτημα, όμως, θα γίνεται σοβαρότερο όσο τα ρομπότ αρχίζουν να αλληλεπιδρούν με περισσότερους ανθρώπους σε πολυσύχναστα και απρόβλεπτα περιβάλλοντα, όπως επιχειρήσεις και κατοικίες.
Όπως εξήγησε στο Reuters, τα ρομπότ της Spirit AI διαθέτουν σύστημα ελέγχου της δύναμης σε ολόκληρο το σώμα τους. Εάν καταγραφεί υπερβολική δύναμη κατά την επαφή με έναν άνθρωπο ή ένα αντικείμενο, ενεργοποιείται αυτόματα η πέδηση έκτακτης ανάγκης.
Η βαθύτερη έρευνα γύρω από την ασφάλεια και την ευθυγράμμιση των ρομπότ με τις ανθρώπινες εντολές θα γίνει πιο ουσιαστική όταν τα βασικά μοντέλα περάσουν σε μια ώριμη και πραγματικά αυτόνομη εποχή, την οποία ο Γκάο περιγράφει ως το στάδιο «GPT-4.0».