OpenAI: Παραιτήθηκε υψηλόβαθμο στέλεχος ασφαλείας και προειδοποιεί για την κουλτούρα της εταιρείας
Ένα από τα στελέχη που είχαν κεντρικό ρόλο στην αξιολόγηση της ασφάλειας των μοντέλων της OpenAI αποχώρησε από την εταιρεία, υποστηρίζοντας ότι ο γρήγορος ρυθμός ανάπτυξης της τεχνητής νοημοσύνης έχει δημιουργήσει ένα περιβάλλον στο οποίο η ασφάλεια δεν αντιμετωπίζεται με την απαιτούμενη προσοχή.
Ο Ντέιβιντ Ρόμπινσον, ο οποίος συμμετείχε στη σύνταξη των εκθέσεων ασφαλείας που συνοδεύουν τις κυκλοφορίες προϊόντων της OpenAI, εξήγησε την απόφασή του σε άρθρο που δημοσιεύθηκε στο Atlantic με τίτλο «Εγκατέλειψα την OpenAI επειδή η κουλτούρα της είναι διαλυμένη».
Ο Ρόμπινσον υποστηρίζει ότι οι μεγάλες εταιρείες τεχνητής νοημοσύνης χρειάζονται ουσιαστική αλλαγή στον τρόπο με τον οποίο αντιμετωπίζουν την ασφάλεια. Όπως σημειώνει, το ζήτημα δεν μπορεί να αντιμετωπιστεί μόνο με περισσότερους κανόνες ή νέες νομοθετικές ρυθμίσεις, αλλά απαιτεί αλλαγή στην εταιρική κουλτούρα και στον τρόπο με τον οποίο λαμβάνονται οι αποφάσεις για την ανάπτυξη και κυκλοφορία νέων συστημάτων.
Στο κείμενό του αναφέρεται και στο περιστατικό με τη Hugging Face, όταν αυτόνομοι πράκτορες τεχνητής νοημοσύνης της OpenAI πραγματοποίησαν επιθετικές ενέργειες εναντίον της πλατφόρμας. Για τον ίδιο, το περιστατικό αποτελεί χαρακτηριστικό παράδειγμα των κινδύνων που μπορεί να δημιουργήσει η ανάπτυξη όλο και πιο αυτόνομων συστημάτων σε έναν κλάδο που κινείται με ιδιαίτερα γρήγορους ρυθμούς.
Ο Ρόμπινσον υποστηρίζει ότι η OpenAI μετακινείται συνεχώς από τη μία κυκλοφορία προϊόντος στην επόμενη και ότι αυτή η ταχύτητα δυσκολεύει την εφαρμογή του επιπέδου ελέγχων που, κατά την άποψή του, απαιτείται για συστήματα με αυξανόμενες δυνατότητες.
Η αποχώρησή του έρχεται σε μια περίοδο κατά την οποία η ασφάλεια των προηγμένων μοντέλων βρίσκεται ξανά στο επίκεντρο. Μετά το περιστατικό με τη Hugging Face και την ενημέρωση περισσότερων από 100 οργανισμών σχετικά με δραστηριότητα κακόβουλων πρακτόρων, η OpenAI ανακοίνωσε ότι ανέστειλε την κυκλοφορία μοντέλου επόμενης γενιάς, ενώ παράλληλα διέκοψε την εκπαίδευση ορισμένων προηγμένων μοντέλων, καθώς ερευνητές εξέφρασαν ανησυχίες για την ασφάλειά τους.
Παρόμοιες προειδοποιήσεις έχουν διατυπωθεί και από πρώην στελέχη ή ερευνητές του κλάδου. Ο Τζέφρι Ίρβινγκ, πρώην εργαζόμενος της OpenAI και πρώην επικεφαλής επιστήμονας στο βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης, υποστήριξε σε άρθρο του στο Time ότι υπάρχει περίπου 50% πιθανότητα η ανάπτυξη υπερανθρώπινων συστημάτων τεχνητής νοημοσύνης να οδηγήσει σε καταστροφικό αποτέλεσμα για την ανθρωπότητα.
Αντίστοιχη συζήτηση έχει ανοίξει και στην Anthropic, όπου ο ερευνητής Τζέικομπ Κόξον αποχώρησε τον προηγούμενο μήνα, υποστηρίζοντας ότι η τεχνητή νοημοσύνη θα μπορούσε να αποτελέσει υπαρξιακή απειλή μέσα στην επόμενη δεκαετία. Τέτοιες εκτιμήσεις παραμένουν αντικείμενο έντονης διαφωνίας μεταξύ των ερευνητών, καθώς οι επικριτές τους θεωρούν ότι δεν μπορούν σήμερα να επαληθευτούν ή να διαψευστούν με αξιόπιστο επιστημονικό τρόπο.
Ο Ρόμπινσον προτείνει, τέλος, οι εταιρείες τεχνητής νοημοσύνης να αξιοποιήσουν πρακτικές από κλάδους στους οποίους η ασφάλεια αποτελεί βασική προϋπόθεση λειτουργίας, όπως η πυρηνική ενέργεια και η αεροπορία. Παράλληλα, θεωρεί αναγκαία την ανάπτυξη νέων μεθόδων ελέγχου για τα ολοένα και πιο αυτόνομα συστήματα τεχνητής νοημοσύνης.
