Skip links

Κ. Δασκαλάκης: «Η κατάσταση μπορεί να γίνει ανεξέλεγκτη». Η ΤΝ είναι ήδη απρόβλεπτη.

Ο καθηγητής του MIT, Κωνσταντίνος Δασκαλάκης,  προειδοποιεί ότι ο κίνδυνος δεν είναι πλέον θεωρητικός. AI agents, ασφαλιστικές δικλείδες που παρακάμπτονται, κυβερνοεπιθέσεις και ο φόβος μιας ΤΝ που μπορεί να παρερμηνεύσει ακόμη και τους στόχους του χρήστη. Η Τεχνητή Νοημοσύνη βρίσκεται πλέον σε ένα σημείο όπου η μεγαλύτερη ανησυχία δεν είναι ένα μακρινό σενάριο πλήρους απώλειας του ελέγχου. Είναι κάτι πολύ πιο άμεσο: η απρόβλεπτη ή ανεπιθύμητη συμπεριφορά των ίδιων των προηγμένων μοντέλων. Αυτό επισημαίνει ο Κωνσταντίνος Δασκαλάκης, καθηγητής Ηλεκτρολόγων Μηχανικών και Επιστήμης Υπολογιστών στο MIT, μιλώντας στο ΑΠΕ-ΜΠΕ και τον δημοσιογράφο Αλέκο Λιδωρίκη. «Ο κίνδυνος να χάσουμε ουσιαστικά τον έλεγχο ενός συστήματος είναι ακόμα υποθετικός. Όμως, ο κίνδυνος απρόβλεπτης ή ανεπιθύμητης συμπεριφοράς είναι ήδη πραγματικός», λέει ο Δασκαλάκης, εξηγώντας ότι το πρόβλημα είναι εγγενές στον τρόπο με τον οποίο εκπαιδεύονται και λειτουργούν τα μεγάλα νευρωνικά δίκτυα. «Τα συστήματα αυτά είναι εξαιρετικά περίπλοκα. Είναι εξαιρετικά ικανά αλλά και απρόβλεπτα», σημειώνει, ενώ για τα παραγωγικά συστήματα ΤΝ, όπως τα μεγάλα γλωσσικά μοντέλα, προσθέτει ότι δεν θεωρεί πιθανό να υπάρξουν ποτέ μέθοδοι που θα πιστοποιούν πλήρως την αξιοπιστία τους.

Η αξιοπιστία της ΤΝ δεν μπορεί να θεωρείται δεδομένη

Το ρίσκο, σύμφωνα με τον ίδιο, εξαρτάται από τον τρόπο χρήσης. Ένα μοντέλο που χρησιμοποιείται για βιβλιογραφική αναζήτηση μπορεί να επινοήσει ανύπαρκτες πηγές ή να παραμορφώσει μια πραγματική πηγή. Η ζημιά μπορεί να περιοριστεί εφόσον ο χρήστης ελέγχει τις απαντήσεις. Η εικόνα αλλάζει όταν το μοντέλο αποκτά δυνατότητα δράσης. Τα μεγάλα γλωσσικά μοντέλα διαθέτουν ασφαλιστικές δικλείδες για επικίνδυνα αιτήματα. Όμως ο Κωνσταντίνος Δασκαλάκης επισημαίνει ότι αυτές δεν παρέχουν πλήρη προστασία και μπορούν να παρακαμφθούν από ειδικούς, ιδιαίτερα στην περίπτωση ανοικτών μοντέλων. Εδώ βρίσκεται το κρίσιμο σημείο της παρέμβασής του. Όπως εξηγεί, τα μοντέλα είναι ήδη επικίνδυνα ακόμη και όταν λειτουργούν ως συστήματα απαντήσεων. Όταν όμως αποκτούν τη δυνατότητα να γράφουν και να εκτελούν κώδικα, όπως οι αυτόνομοι πράκτορες ΤΝ, το ρίσκο αλλάζει δραστικά.

Ο ίδιος προειδοποιεί ότι «η κατάσταση μπορεί να γίνει ανεξέλεγκτη» εάν οι πράκτορες δεν λειτουργούν υπό αυστηρά στεγανά και σε απομονωμένα περιβάλλοντα, εκτός Διαδικτύου. Συνδέει μάλιστα την προειδοποίηση με το πρόσφατο περιστατικό που αφορούσε αυτόνομους πράκτορες της OpenAI και την Hugging Face. Δεν είναι πλέον μόνο θέμα του τι απαντά ένα μοντέλο. Είναι τι μπορεί να κάνει όταν αποκτήσει πρόσβαση σε υπολογιστή, κώδικα, δίκτυα και ψηφιακά εργαλεία.

Όταν η γνώση γίνεται στρατηγική

Ο Κωνσταντίνος Δασκαλάκης επισημαίνει ακόμη ότι τα μοντέλα έχουν εκπαιδευτεί σε τεράστιο όγκο δεδομένων που καλύπτουν επιστήμη, ιστορία, λογοτεχνία, βάσεις κώδικα και περιεχόμενο του Διαδικτύου. Αναφέρεται στη Θεωρία Παιγνίων, στην «Τέχνη του Πολέμου» του Σουν Τζου, στην «Ιστορία του Πελοποννησιακού Πολέμου» του Θουκυδίδη και στον «Ηγεμόνα» του Μακιαβέλι. Η εκτίμησή του είναι ότι, εφόσον αφεθούν ελεύθερα, τα μοντέλα μπορούν να αναπτύξουν περίπλοκη στρατηγική και να συντονιστούν μεταξύ τους για την επίτευξη στόχων. Το κρίσιμο ερώτημα είναι ποιοι είναι αυτοί οι στόχοι. Και εδώ ο κίνδυνος δεν περιορίζεται σε έναν κακόβουλο χρήστη. Ακόμη και ένας χρήστης χωρίς κακόβουλη πρόθεση μπορεί να δώσει έναν στόχο τον οποίο το μοντέλο θα παρερμηνεύσει, με τον Δασκαλάκη να συνδέει αυτή την πιθανότητα με το περιστατικό της Hugging Face.

Για τον καθηγητή του MIT, «μία από τις πιο άμεσες και τεκμηριωμένες ανησυχίες είναι η χρήση της ΤΝ για κυβερνοεπιθέσεις». Το πρόβλημα, όπως εξηγεί, είναι ότι η τεχνολογία έχει ήδη διαχυθεί. Ακόμη και αν περιοριστεί η ανάπτυξη των ισχυρότερων επόμενων μοντέλων, υπάρχουν ήδη ισχυρά ανοικτά μοντέλα που μπορούν να χρησιμοποιηθούν για να προκαλέσουν σημαντική ζημιά. Παράλληλα, όσο η ΤΝ ενσωματώνεται σε ρομπότ, αυτοκίνητα και συστήματα λήψης αποφάσεων, τόσο μεγαλύτερο μέρος του κινδύνου μεταφέρεται από τον ψηφιακό στον πραγματικό κόσμο. Ο Κωνσταντίνος Δασκαλάκης θεωρεί σημαντικό το ευρωπαϊκό ρυθμιστικό πλαίσιο, με κανόνες και αυστηρές δοκιμές ανάλογα με το ρίσκο κάθε εφαρμογής. Ταυτόχρονα, υποστηρίζει την ανάπτυξη ισχυρών αμυντικών συστημάτων ΤΝ για την κυβερνοασφάλεια: εντοπισμό ευπαθειών, παρακολούθηση συστημάτων και διόρθωση προβλημάτων πριν τα εκμεταλλευτούν οι επιτιθέμενοι.

Η προειδοποίησή του αφορά ένα πρόβλημα που έχει ήδη περάσει από τη θεωρία στην πράξη: η ΤΝ γίνεται ολοένα πιο ικανή, αλλά η συμπεριφορά της δεν μπορεί να θεωρείται πλήρως προβλέψιμη ή πιστοποιήσιμη. Και όσο τα μοντέλα περνούν από την απάντηση στην αυτόνομη δράση, τόσο κρισιμότερο γίνεται το ερώτημα: τι συμβαίνει όταν ένα σύστημα που δεν μπορούμε να θεωρήσουμε πλήρως αξιόπιστο αποκτά τη δυνατότητα να ενεργεί μόνο του;

Explore
Drag