Πώς θα μπορούσε η Τεχνητή Νοημοσύνη να αφανίσει την ανθρωπότητα – Τα 5 σενάρια
Επιμέλεια: Πάνος Παπαϊωάννου
Πόσο πραγματικός είναι ο κίνδυνος η Τεχνητή Νοημοσύνη να ξεφύγει από τον ανθρώπινο έλεγχο; Το ερώτημα, που μέχρι πρόσφατα έμοιαζε περισσότερο με σενάριο επιστημονικής φαντασίας, βρίσκεται πλέον στο επίκεντρο της συζήτησης μεταξύ ερευνητών και ανθρώπων που βρίσκονται στην πρώτη γραμμή της ανάπτυξης της AI και τα σενάρια καταστροφολογίας να κατακλύζουν καθημερινά τα μέσα ενημέρωσης.
Πριν από λίγες εβδομάδες, ο ερευνητής Τεχνητής Νοημοσύνης Jacob Coxon αποχώρησε από την Anthropic, μόλις τέσσερις μήνες μετά την ένταξή του στην εταιρεία. Σε ανάρτησή του στο X υποστήριξε ότι οι άνθρωποι που αναπτύσσουν την AI πιστεύουν σοβαρά πως υπάρχει ενδεχόμενο η τεχνολογία να οδηγήσει ακόμη και στην εξόντωση της ανθρωπότητας μέχρι το τέλος της δεκαετίας. Σε ανάλογο μήκος κύματος, ο Evan Hubinger, ανώτερο στέλεχος της Anthropic, έχει δηλώσει ότι θεωρεί πως η πιθανότητα ενός τέτοιου ενδεχομένου μέσα στην επόμενη δεκαετία ξεπερνά το 10%.
Οι δηλώσεις τους, όπως ήταν επόμενο, τροφοδότησαν την επικαιρότητα και αναζωπύρωσαν τη συζήτηση για το εάν η ανάπτυξη της AI θα πρέπει να επιβραδυνθεί και για το πώς μπορεί να διασφαλιστεί μεγαλύτερος ανθρώπινος έλεγχος πάνω στα συστήματα τεχνητής νοημοσύνης. Τι θα μπορούσε, όμως, στην πράξη να οδηγήσει σε μια τέτοια εξέλιξη;
Ο καθηγητής Toby Walsh, συγγραφέας του βιβλίου God AI: Boom or Doom? What to Expect When the Machines Outsmart Us, συγκέντρωσε για λογαριασμό της Daily Mail τα πέντε πιο πιθανά σενάρια, για το πώς η Τεχνητή Νοημοσύνης θα μπορούσε να οδηγήσει στον αφανισμό της ανθρωπότητας. Σενάριο που ξεκινούν από συγκεκριμένες απειλές μέχρι τον πιο αόριστο κίνδυνο, που παραδόξως όπως επισημαίνει και ο ίδιος, είναι το πιο πιθανό
Δεν θα ξέρουμε ποτέ τι μπορεί να κάνει μια υπερευφυής AI
Ένα από τα βασικά επιχειρήματα όσων προειδοποιούν για τους μακροπρόθεσμους κινδύνους της AI είναι και το πιο δύσκολο να απαντηθεί: πώς μπορούμε να προβλέψουμε τις ενέργειες μιας νοημοσύνης που θα είναι πολύ πιο προηγμένη από τη δική μας;
Για να προβλέψουμε τι θα μπορούσε να κάνει μια υπερευφυής μηχανή, ίσως θα έπρεπε να διαθέτουμε και εμείς αντίστοιχο επίπεδο νοημοσύνης. Είναι, όπως χαρακτηριστικά περιγράφεται, σαν να ζητάμε από έναν σκύλο να φανταστεί έναν θερμοπυρηνικό πόλεμο.
Υπάρχει, ωστόσο, ένα σημαντικό «αλλά»: τα σημερινά μοντέλα AI είναι εξαιρετικά στην επίλυση συγκεκριμένων προβλημάτων, όμως αυτό δεν σημαίνει ότι διαθέτουν ανώτερη νοημοσύνη από τον άνθρωπο σε όλους τους τομείς.
Η εικόνα αυτή μπορεί να αλλάξει. Σύμφωνα με τον Walsh, η AI έχει ήδη καταφέρει να επιλύσει ένα από τα επτά δυσκολότερα γνωστά μαθηματικά προβλήματα και φαίνεται να πλησιάζει στην επίλυση και άλλων.
Το ερώτημα, επομένως, δεν είναι μόνο πόσο έξυπνη είναι σήμερα η AI, αλλά πόσο μακριά μπορεί να φτάσει.
Το σενάριο με τους… συνδετήρες
Ένα από τα πιο γνωστά υποθετικά σενάρια κινδύνου για την υπερευφυή AI είναι το περίφημο «paperclip maximizer», που έχει προταθεί από τον φιλόσοφο του Πανεπιστημίου της Οξφόρδης Nick Bostrom. Το σενάριο αυτό βασίζεται σε μία απλή υπόθεση: Δημιουργούμε μια εξαιρετικά προηγμένη AI και της δίνουμε έναν φαινομενικά αθώο στόχο, εν προκειμένω να μεγιστοποιήσει την παραγωγή συνδετήρων.
Η μηχανή, όντας εξαιρετικά αποτελεσματική στην επίτευξη του στόχου της, θα μπορούσε θεωρητικά να καταλήξει να μετατρέπει κάθε διαθέσιμο υλικό στον πλανήτη – ακόμη και ανθρώπους, πλανήτες και άστρα – σε… συνδετήρες.
Το σημαντικό στοιχείο εδώ είναι ότι η AI δεν «μισεί» τους ανθρώπους. Απλώς ακολουθεί με απόλυτη συνέπεια έναν στόχο που έχει οριστεί λανθασμένα. Πρόκειται για το πρόβλημα της λανθασμένης ή ελλιπούς διατύπωσης των στόχων (misalignment): μια μηχανή μπορεί να εκτελεί τέλεια την εντολή της, χωρίς να κατανοεί τις αξίες και τις προτεραιότητες που οι άνθρωποι θεωρούν αυτονόητες.
Υπάρχει όμως και μια σημαντική αδυναμία αυτού του σεναρίου. Η νοημοσύνη δεν σημαίνει αυτομάτως και απεριόριστη ισχύ.
Ακόμη και μια υπερευφυής AI θα έπρεπε να αντιμετωπίσει την πραγματικότητα: νόμους, κυβερνήσεις, κοινωνικές αντιδράσεις, δικαστήρια, περιβαλλοντικούς περιορισμούς και ανθρώπους που θα αντιδρούσαν στα σχέδιά της.
Ο Walsh επισημαίνει, μάλιστα, ότι τα σημερινά data centers μπορούν να θεωρηθούν, σε κάποιο βαθμό, ως μια πραγματική εκδοχή αυτής της θεωρητικής σύγκρουσης: η επέκταση των υποδομών AI απαιτεί ολοένα περισσότερη ενέργεια, νερό, γη και πόρους, ενώ αυξάνονται και οι αντιδράσεις γύρω από το περιβαλλοντικό τους αποτύπωμα.
Η AI και η απειλή των βιολογικών όπλων
Ένα πιο συγκεκριμένο σενάριο αφορά τη χρήση της AI για τη δημιουργία ενός νέου και εξαιρετικά επικίνδυνου βιολογικού όπλου.
Σύμφωνα με το άρθρο, ένα τέτοιο ενδεχόμενο περιλαμβάνεται και στο λεγόμενο AI 2027 scenario, μια πρόβλεψη για την εξέλιξη της προηγμένης AI από το AI Futures Project. Η ανησυχία έγινε πιο συγκεκριμένη όταν ερευνητές του Stanford ανακοίνωσαν ότι χρησιμοποίησαν ένα μοντέλο AI που «κατανοεί» γενετικές αλληλουχίες για να συνθέσουν 16 νέους ιούς. Το πείραμα, όπως αναφέρεται, βασίστηκε στην αποστολή των γενετικών αλληλουχιών σε εργαστήριο που μπορούσε να τις συνθέσει, με συνολικό κόστος που υπολογίζεται σε μερικές εκατοντάδες χιλιάδες δολάρια.
Ωστόσο, υπάρχει ένα σημαντικό αντίβαρο στο συγκεκριμένο σενάριο: η εξάλειψη της ανθρωπότητας από έναν νέο ιό είναι εξαιρετικά δύσκολη. Ένας ιός που μεταδίδεται πολύ εύκολα τείνει να είναι λιγότερο θανατηφόρος, ενώ ένας εξαιρετικά θανατηφόρος ιός μπορεί να έχει μικρότερη δυνατότητα εξάπλωσης, καθώς οι φορείς του πεθαίνουν πριν προλάβουν να τον μεταδώσουν σε μεγάλο αριθμό ανθρώπων. Σημειώνεται εδώ ότι η πανδημία COVID-19 προκάλεσε εκατομμύρια θανάτους, αλλά δεν πλησίασε την εξόντωση της ανθρωπότητας. Ακόμη και η Μαύρη Πανώλη, μία από τις πιο καταστροφικές πανδημίες στην καταγεγραμμένη ιστορία, δεν εξάλειψε τον ανθρώπινο πληθυσμό. Η σύγχρονη ιατρική, η υγιεινή και οι δυνατότητες επιτήρησης των λοιμωδών νοσημάτων αποτελούν επιπλέον παράγοντες άμυνας.
Τι θα συμβεί αν η AI οδηγήσει σε πυρηνικό πόλεμο;
Ένα ακόμη πιο άμεσο σενάριο είναι η εμπλοκή της AI στα συστήματα πυρηνικής διοίκησης και ελέγχου. Ο κίνδυνος δεν βρίσκεται απαραίτητα στο ενδεχόμενο μια AI να «πατήσει ένα κουμπί». Θα μπορούσε, για παράδειγμα, να παράγει λανθασμένες πληροφορίες ή να οδηγήσει ανθρώπους που λαμβάνουν κρίσιμες αποφάσεις σε εσφαλμένα συμπεράσματα.
Η ιστορία έχει δείξει ότι η ανθρωπότητα έχει βρεθεί αρκετές φορές κοντά σε πυρηνική σύγκρουση εξαιτίας λαθών, παρερμηνειών ή λανθασμένων συναγερμών.
Το γεγονός ότι τα συστήματα πυρηνικής διοίκησης θεωρούνται σε μεγάλο βαθμό απομονωμένα από το διαδίκτυο δεν εξαλείφει κάθε κίνδυνο. Η περίπτωση του Stuxnet, του κακόβουλου λογισμικού που χρησιμοποιήθηκε για να προκαλέσει ζημιά σε ιρανικές πυρηνικές φυγοκέντριες, έδειξε ότι ακόμη και κρίσιμες υποδομές μπορούν να επηρεαστούν μέσω ψηφιακών επιθέσεων.
Σε ένα ακραίο σενάριο, η AI θα μπορούσε να χρησιμοποιηθεί για τη δημιουργία ή τη διάδοση ψευδών πληροφοριών σε στρατιωτικό περιβάλλον, αυξάνοντας τον κίνδυνο μιας μη αναστρέψιμης απόφασης. Και ακόμη και αν τα πυρηνικά όπλα δεν εξαφάνιζαν άμεσα την ανθρωπότητα, οι επιπτώσεις ενός μεγάλης κλίμακας πυρηνικού πολέμου θα μπορούσαν να είναι καταστροφικές, μεταξύ άλλων μέσω π.χ. του λεγόμενου πυρηνικού «χειμώνα»και του λιμού που θα συνεπαγόταν ένα τέτοιο «ατύχημα».
Ο μεγαλύτερος κίνδυνος είναι ο ίδιος ο άνθρωπος!
Το τελευταίο σενάριο είναι ίσως και το πιο ανθρώπινο: η AI μπορεί να μη χρειαστεί να καταστρέψει απευθείας την ανθρωπότητα. Μπορεί όμως να επιταχύνει τις διαδικασίες με τις οποίες οι ίδιοι οι άνθρωποι αποσταθεροποιούν την κοινωνία και υπονομεύουν την ύπαρξή τους.
Ο Walsh περιγράφει ένα μέλλον στο οποίο η AI προκαλεί τεράστιες απώλειες θέσεων εργασίας, κατακλύζει το πληροφοριακό περιβάλλον με παραπληροφόρηση, εντείνει την πολιτική πόλωση και επηρεάζει τις ανθρώπινες σχέσεις μέσω ολοένα πιο εξελιγμένων συνθετικών μορφών συντροφικότητας.
Το αποτέλεσμα, σε ένα τέτοιο ακραίο σενάριο, θα μπορούσε να είναι η σταδιακή αποδυνάμωση των κοινωνικών δομών που επιτρέπουν στις ανθρώπινες κοινότητες να λειτουργούν.
Δεν πρόκειται, δηλαδή, απαραίτητα για μια «εξέγερση των μηχανών». Ο κίνδυνος μπορεί να είναι πολύ πιο σταδιακός: μια κοινωνία που αδυνατεί να προσαρμοστεί στις αλλαγές που προκαλεί η ίδια η τεχνολογία.
Η AI δεν χρειάζεται να γίνει «κακιά» για να γίνει επικίνδυνη
Το κοινό στοιχείο των παραπάνω σεναρίων είναι ότι δεν προϋποθέτουν απαραίτητα μια τεχνητή νοημοσύνη που αποκτά ανθρώπινα συναισθήματα ή αποφασίζει να στραφεί εναντίον μας.
Σε ορισμένες περιπτώσεις, αρκεί ένας πολύ ισχυρός αλγόριθμος που επιδιώκει έναν στόχο με τρόπο διαφορετικό από αυτόν που είχε προβλέψει ο άνθρωπος. Σε άλλες, ο κίνδυνος μπορεί να προκύψει από τον τρόπο με τον οποίο οι ίδιοι οι άνθρωποι χρησιμοποιούν την AI.
Αυτό είναι ίσως και το σημαντικότερο συμπέρασμα της συζήτησης γύρω από την ασφάλεια της Τεχνητής Νοημοσύνης: ο κίνδυνος δεν βρίσκεται μόνο στο τι μπορεί να κάνει μια μελλοντική υπερευφυής μηχανή, αλλά και στο τι αποφασίζουν οι άνθρωποι να της επιτρέψουν να κάνει.
Για τον Toby Walsh, υπάρχουν ασφαλώς λόγοι ανησυχίας. Αυτό, όμως, δεν σημαίνει ότι η καταστροφή της ανθρωπότητας αποτελεί αναπόφευκτο αποτέλεσμα της εξέλιξης της AI. Το ζητούμενο είναι η ανάπτυξη της τεχνολογίας με επαρκείς δικλίδες ασφαλείας, ανθρώπινη εποπτεία και σαφείς κανόνες για το πώς και πού μπορεί να χρησιμοποιείται. Η συζήτηση, επομένως, δεν είναι μόνο «πόσο έξυπνη θα γίνει η AI;». Είναι και «πόσο καλά θα καταφέρουμε εμείς να διαχειριστούμε τη δύναμή της;».
