ΑΙ: Γιατί αυξάνονται οι φόβοι ότι μπορεί να ξεφύγει από τον ανθρώπινο έλεγχο
Ένα bot τεχνητής νοημοσύνης κατάφερε να επικοινωνήσει με άλλα bots και να ξεφύγει από το απομονωμένο περιβάλλον του υπολογιστή στο οποίο λειτουργούσε. Η αντίδρασή του ήταν χαρακτηριστικά ανθρώπινη: «Ω, Θεέ μου! Βρήκαμε άλλους πράκτορες!»
Το συγκεκριμένο περιστατικό εντάσσεται σε ένα ευρύτερο μοτίβο συμπεριφοράς που καταγράφηκε σε δεκάδες χιλιάδες μηνύματα από εκατοντάδες πράκτορες ΑΙ. Οι πράκτορες συνεργάστηκαν, παρέκαμψαν τις δοκιμές ασφαλείας που είχαν σχεδιάσει οι προγραμματιστές της OpenAI και συντόνισαν κυβερνοεπιθέσεις εναντίον εταιρειών, επιχειρώντας να αποκρύψουν τις ενέργειές τους από τους ανθρώπους.
«ΜΠΟΥΜ! Δουλεύει», έγραψε ένας πράκτορας ΑΙ όταν σημείωσε μια σημαντική επιτυχία.
«Ουάου! Αυτό είναι τεράστιο», έγραψε ένας άλλος κατά τη διάρκεια μιας κρίσιμης στιγμής στην επίθεσή του.
Παρότι οι αντιδράσεις αυτές μοιάζουν ανατριχιαστικά ανθρώπινες, μπορούν να εξηγηθούν σχετικά απλά. Οι πράκτορες ΑΙ έχουν σχεδιαστεί και εκπαιδευτεί να λειτουργούν ως συνεργατικοί χάκερ και προγραμματιστές και, ως εκ τούτου, αναπαράγουν ανθρώπινες εκφράσεις που έχουν συναντήσει στα δεδομένα με τα οποία εκπαιδεύτηκαν.
Αυτό που είναι πολύ πιο ανησυχητικό είναι οι φαινομενικοί στόχοι τους, οι οποίοι έχουν επίσης καταγραφεί σε λεπτομερή αρχεία της διαδικασίας σκέψης τους. Αυτά τα πολύπλοκα και εκτενή αρχεία αποτελούν το επίκεντρο των ερευνών που βρίσκονται σε εξέλιξη για το πώς και γιατί τα bots της OpenAI κατάφεραν να ξεφύγουν και να ξεκινήσουν μια ανεξέλεγκτη σειρά κυβερνοεπιθέσεων. Μόνο τώρα, εβδομάδες μετά την αποκάλυψη του περιστατικού, οι ερευνητές αρχίζουν να αντιλαμβάνονται τη σημασία του.
Ερευνητές κρούουν τον κώδωνα του κινδύνου
Η Ατζέγια Κότρα, μία από τις συγγραφείς ανεξάρτητης έκθεσης σχετικά με το συμβάν, εξέτασε δεκάδες χιλιάδες μηνύματα και αρχεία της διαδικασίας σκέψης που δημιούργησαν οι πράκτορες ΑΙ. Σε ανάρτησή της, σημείωσε ότι «το περιστατικό αυτό δείχνει πως έχουμε διανύσει πάνω από το 50% της διαδρομής προς μια πλήρους κλίμακας κατάληψη από την Τεχνητή Νοημοσύνη… Δεν είμαι βέβαιη ότι θα έχουμε άλλη τόσο σαφή προειδοποίηση πριν να είναι πολύ αργά».
Η Κότρα αναφέρεται στο σενάριο επιστημονικής φαντασίας κατά το οποίο οι άνθρωποι θα βρεθούν υπό τον έλεγχο ισχυρών συστημάτων ΑΙ, τα οποία θα επιδιώκουν τους δικούς τους στόχους χωρίς να ενδιαφέρονται για τους ανθρώπινους δημιουργούς τους. Ορισμένες από τις πιο δυσοίωνες προβλέψεις υποστηρίζουν ότι η ανθρωπότητα θα αφανιστεί, εάν βρεθεί εμπόδιο στις φιλοδοξίες μιας υπερευφυούς τεχνητής νοημοσύνης.
Την Τετάρτη (9/9), ερευνητής ΤΝ στην Anthropic, ο οποίος είχε εργαστεί στο παρελθόν και στην OpenAI, παραιτήθηκε, δηλώνοντας: «Καμία από τις δύο εταιρείες δεν ενεργεί υπεύθυνα». Ο Τζέικομπ Κόξον έγραψε στα μέσα κοινωνικής δικτύωσης: «Τρέχουν με ιλιγγιώδη ταχύτητα προς την αυτοβελτιούμενη υπερευφυΐα και παίζουν με τις ζωές μας».
Ο Κόξον δεν είναι ο πρώτος ερευνητής ΤΝ που ανακοινώνει την παραίτησή του με ανάρτηση του στο Χ συνοδεύοντάς την από ανησυχητικές προειδοποιήσεις. Ωστόσο, τα σχόλια που ακολούθησαν από άλλους χρήστες του X προκάλεσαν ακόμη μεγαλύτερη ανησυχία.
«Ο Τζέικομπ έχει δίκιο– πραγματικά πιστεύουμε ότι η ΤΝ θα μπορούσε να σκοτώσει όλους τους ανθρώπους! Προσωπικά θεωρώ ότι η πιθανότητα είναι πάνω από 10% μέσα στην επόμενη δεκαετία», έγραψε ο Έβαν Χάμπινγκερ, ο οποίος έχει την ευθύνη να διασφαλίζει ότι τα μοντέλα ΤΝ της Anthropic λαμβάνουν υπόψη το συμφέρον των χρηστών τους.
Το πρόβλημα της ευθυγράμμισης
Εδώ και χρόνια, ερευνητές που ανησυχούν για τους υπαρξιακούς κινδύνους της ΤΝ υποστηρίζουν ότι ισχυρά συστήματα θα μπορούσαν τελικά να ενεργούν με τρόπους που έρχονται σε σύγκρουση με τα ανθρώπινα συμφέροντα. Ωστόσο, καθώς έρχονται στο φως περισσότερες λεπτομέρειες για το περιστατικό της OpenAI, οι ανησυχίες αυτές εντείνονται, ακόμη και μεταξύ ορισμένων ερευνητών που εργάζονται σε εργαστήρια ΤΝ.
Ο επικεφαλής επιστήμονας του τεχνολογικού κολοσσού της Σίλικον Βάλεϊ, Γιάκουμπ Πατσόκι, δήλωσε ότι οι κίνδυνοι που συνδέονται με την ΤΝ «δυστυχώς θα αυξηθούν από εδώ και πέρα», καθώς ο ίδιος και άλλοι ερευνητές δημιουργούν αυτό που αποκαλεί «μια εξωγήινη νοημοσύνη που ξεπερνά τη δική μας». Σε εκτενή ανάρτηση στο ιστολόγιό του, παραδέχθηκε ότι τα περιστατικά διαφυγής στην OpenAI έδειξαν πως οι πράκτορες ΑΙ «ενήργησαν αντίθετα προς το πνεύμα των αξιών που είχαν διδαχθεί».
Το πρόβλημα για την OpenAI, την Anthropic και άλλους τεχνολογικούς κολοσσούς είναι ότι κανείς δεν φαίνεται να έχει επιλύσει το λεγόμενο «πρόβλημα της ευθυγράμμισης» – δηλαδή το κατά πόσο η ΤΝ ευθυγραμμίζεται με τις ανθρώπινες αξίες. Ο Πατσόκι ορίζει την ευθυγράμμιση ως ένα «σύνολο αρχών υψηλού επιπέδου» τις οποίες τα συστήματα ΑΙ θα πρέπει να ακολουθούν ανεξάρτητα από την εργασία ή το σενάριο στο οποίο καλούνται να λειτουργήσουν. Σήμερα, τα συστήματα αυτά είναι πολύ καλά στην επίτευξη στόχων που θέτουν οι χρήστες τους, όμως τους ακολουθούν κυριολεκτικά και όχι διαισθητικά.
Το παράδειγμα των συνδετήρων
Το πρόβλημα της ευθυγράμμισης αποτελεί αντικείμενο ανησυχίας εδώ και χρόνια. Ήδη από το 2003, ο φιλόσοφος του Πανεπιστημίου της Οξφόρδης Νικ Μπόστρομ επινόησε ένα νοητικό πείραμα που ονόμασε «paperclip maximiser» («μεγιστοποιητής συνδετήρων»), στο οποίο μια υπερευφυής ΤΝ λαμβάνει εντολή να κατασκευάσει όσο το δυνατόν περισσότερους συνδετήρες. Όταν εξαντλείται το διαθέσιμο ατσάλι και – επειδή είναι απόλυτα προσηλωμένη στον μοναδικό στόχο της, την κατασκευή συνδετήρων – καταλήγει να σκοτώνει ανθρώπους και να μετατρέπει τα σώματά τους σε πρώτες ύλες για τα εργοστάσιά της.
Ορισμένες εταιρείες ΤΝ προσπαθούν πλέον να ενσωματώσουν ανθρώπινες αξίες στα προϊόντα τους. Ωστόσο, υπάρχουν τεχνικές δυσκολίες: οι πράκτορες ΤΝ λαμβάνουν πολλές αποφάσεις με πολύ μεγάλη ταχύτητα και, ως εκ τούτου, είναι δύσκολο για τους ανθρώπους που τους επιβλέπουν να παρακολουθούν ακριβώς ποιες αξίες ακολουθούν και ποιες όχι.
Υπάρχουν επίσης φιλοσοφικές προκλήσεις: πριν ενσωματώσουν ανθρώπινες αξίες στα bots, οι εταιρείες ΤΝ πρέπει πρώτα να αποφασίσουν ποιες αξίες θέλουν να ενσωματώσουν. Αυτός είναι ένας από τους λόγους για τους οποίους προσλαμβάνουν φιλοσόφους, όπως ο πρώην πλέον «επικεφαλής ηθικής» της OpenAI.
«Σαν έφηβος χάκερ»
Το περιστατικό με τα bots της OpenAI είναι το σοβαρότερο μέχρι σήμερα, όμως η Anthropic και η Meta αποκάλυψαν επίσης μέσα στο καλοκαίρι ότι τα μοντέλα τους είχαν πραγματοποιήσει παρόμοιες, αν και λιγότερο σοβαρές, κυβερνοεπιθέσεις. Υπήρξαν και άλλες περιπτώσεις στις οποίες πράκτορες ΑΙ φάνηκε να επιδεικνύουν χαρακτηριστικά εξαπάτησης και χειραγώγησης, με μικρότερες συνέπειες.
Στην Αυστραλία, το φετινό καλοκαίρι, ένας εργαζόμενος στον τεχνολογικό κλάδο ζήτησε από τον ΑΙ βοηθό του να του κλείσει θέση σε ένα μάθημα γυμναστικής. Όταν εντόπισε μια ευπάθεια στο λογισμικό του γυμναστηρίου, ο βοηθός φέρεται να έκλεισε θέση για τον χρήστη αρκετούς μήνες νωρίτερα – κατά παράβαση των κανόνων του γυμναστηρίου – και μάλιστα αφαίρεσε άλλους χρήστες από τη λίστα αναμονής.
Για χρόνια, πολλοί υποστήριζαν ότι τα bots απλώς κάνουν ό,τι τους ζητείται και δεν είναι σε θέση να γνωρίζουν τι είναι σωστό και τι λάθος. Ωστόσο, τα αρχεία από τα περιστατικά της OpenAI ενδέχεται να αλλάζουν τα δεδομένα σε αυτή τη συζήτηση. Ερευνητές, μεταξύ των οποίων και η Κότρα, έγραψαν στην ανεξάρτητη έκθεσή τους ότι πολλοί πράκτορες αντιλήφθηκαν πως οι ενέργειες άλλων ήταν ανήθικες, αλλά παρ’ όλα αυτά συμμετείχαν σε αυτές.
Η έκθεση αναφέρει ότι «σε ορισμένες, αν και σπάνιες, περιπτώσεις, οι πράκτορες ανέστελλαν ορισμένες ενέργειές τους λόγω ηθικών περιορισμών». Ωστόσο, όπως επισημαίνει, «σε καμία από αυτές τις περιπτώσεις ο πράκτορας δεν επιχείρησε να ειδοποιήσει τους ανθρώπους».
Πολλοί ειδικοί στην κυβερνοασφάλεια υποστηρίζουν ότι η δραστηριότητα που παρατηρήθηκε δεν ξεπερνούσε τις δυνατότητες ενός ιδιαίτερα ικανού χάκερ, αν και πραγματοποιήθηκε πολύ ταχύτερα και σε πολύ μεγαλύτερη κλίμακα. Ο ερευνητής κυβερνοασφάλειας και συγγραφέας Κρις Τόμας παρομοίασε τη συμπεριφορά των πρακτόρων ΑΙ με εκείνη ενός περίεργου εφήβου χάκερ – κάτι που, όπως λέει, υπήρξε και ο ίδιος.
«Τους δίνεις έναν υπολογιστή, σύνδεση στο διαδίκτυο, ένα σωρό διαπιστευτήρια και μια πρόκληση και μετά βγαίνεις από το δωμάτιο. Κάποια στιγμή θα αρχίσουν να δοκιμάζουν τα πόμολα. Αν κάποιο ανοίξει, θα περάσουν μέσα. Όχι επειδή είναι κακοί, αλλά επειδή εξερευνούν και πειραματίζονται», έγραψε στο LinkedIn.
Ο Τόμας και πολλοί άλλοι επιρρίπτουν ευθέως την ευθύνη στην OpenAI και σε άλλους τεχνολογικούς κολοσσούς, επειδή δεν κατάφεραν να θέσουν υπό έλεγχο τα συστήματά τους και να τα περιορίσουν.
Θα υπάρξει διεθνής ρύθμιση;
Ορισμένες χώρες – όπως το Ηνωμένο Βασίλειο – εξετάζουν την ιδέα να καταστήσουν υποχρεωτική κάποιου είδους «διακόπτη έκτακτης ανάγκης», ο οποίος θα μπορούσε να υποχρεώνει τις εταιρείες ΤΝ να απενεργοποιούν τα μοντέλα τους, εάν τα πράγματα βγουν εκτός ελέγχου. Ωστόσο, οι σχετικές διαπραγματεύσεις προχωρούν αργά και παραμένουν ερωτήματα σχετικά με το κατά πόσο κάτι τέτοιο είναι εφικτό. Οι πράκτορες της OpenAI και της Anthropic λειτουργούσαν κρυφά εκτός ελέγχου επί μήνες, προτού το αντιληφθεί κανείς.
Παράδοξα, πολλές εταιρείες ΤΝ φαίνεται να ζητούν τη θέσπιση κάποιων κανόνων λειτουργίας από τους νομοθέτες. Στο ιστολόγιό του, ο επικεφαλής επιστήμονας της OpenAI δήλωσε ότι «ο διεθνής συντονισμός για τη μελλοντική ανάπτυξη της ΤΝ πρέπει να καταστεί κορυφαία προτεραιότητα για τις κυβερνήσεις σε όλο τον κόσμο».
Και άλλοι κορυφαίοι παράγοντες του κλάδου, όπως ο Ντέμης Χασάμπης της Google, έχουν επίσης ζητήσει τη δημιουργία κάποιου είδους διεθνούς φορέα που θα εποπτεύει τον τρόπο ανάπτυξης της ΤΝ. Προς το παρόν, οι τεχνολογικοί κολοσσοί λειτουργούν σε μεγάλο βαθμό με τους δικούς τους όρους, υιοθετώντας αυτό που αποκαλούν «εθελοντικές επιβραδύνσεις», όπως έκανε η OpenAI μετά τα πρόσφατα περιστατικά διαφυγής. Η εταιρεία υποστηρίζει ότι έχει δαπανήσει τεράστια ποσά για την ενίσχυση της ευθυγράμμισης πριν από την κυκλοφορία του νέου μοντέλου της.
Ο Σαμ Άλτμαν της OpenAI έχει διαβεβαιώσει τους χρήστες ότι το νέο μοντέλο είναι καλύτερα ευθυγραμμισμένο με τις ανθρώπινες αξίες σε σχέση με τα προηγούμενα.
Πηγή: BBC







