OpenAI: Παραιτήθηκε υψηλόβαθμο στέλεχος – Προειδοποιεί για “πυρηνικού επιπέδου” κινδύνους από την ΑΙ

Η OpenAI έχει βασιστεί σε μεγάλο βαθμό στη δοκιμή και το λάθος (trial & error), όμως το περιθώριο για τέτοιες αστοχίες περιορίζεται όσο αυξάνονται οι δυνατότητες των μοντέλων

Ο Σαμ Άλτμαν της OpenAI © EPA/FRANCK ROBICHON

Πρόσφατη αποχώρηση υψηλόβαθμου μάνατζερ της OpenAI, ο οποίος ασχολούνταν με την ασφάλεια των συστημάτων τεχνητής νοημοσύνης, αναζωπυρώνει τη συζήτηση για το κατά πόσο οι κορυφαίες εταιρείες του κλάδου μπορούν να συμβαδίσουν με την ταχύτητα ανάπτυξης της τεχνολογίας και τους κινδύνους που αυτή συνεπάγεται.

Ο Ντέιβιντ Ρόμπινσον, που είχε προηγουμένως αναλάβει την ομάδα διαφάνειας της OpenAI στον τομέα ασφάλειας, ανακοίνωσε την αποχώρησή του και σε άρθρο του στο «The Atlantic» άσκησε κριτική στον τρόπο με τον οποίο αναπτύσσονται και λανσάρονται νέα συστήματα.

Σύμφωνα με τον ίδιο, η OpenAI έχει βασιστεί σε μεγάλο βαθμό στη δοκιμή και το λάθος (trial & error), όμως το περιθώριο για τέτοιες αστοχίες περιορίζεται όσο αυξάνονται οι δυνατότητες των μοντέλων τεχνητής νοημοσύνης.

Η αλματώδης ταχύτητα ανάπτυξης της ΑΙ

Ο Ρόμπινσον υποστήριξε ότι οι συνεχείς νέες κυκλοφορίες προϊόντων δημιουργούν ένα περιβάλλον στο οποίο οι διαδικασίες ασφαλείας δεν εξελίσσονται με την ίδια ταχύτητα.

Η ανησυχία αφορά ιδιαίτερα περιπτώσεις κατά τις οποίες ένα σύστημα μπορεί να παρουσιάσει απρόβλεπτη συμπεριφορά κατά τη διάρκεια δοκιμών. Καθώς τα μοντέλα αποκτούν μεγαλύτερες δυνατότητες, ακόμη και ένα σπάνιο σφάλμα θα μπορούσε, σύμφωνα με την επιχειρηματολογία του, να έχει πολύ μεγαλύτερες συνέπειες.

Η θέση αυτή δεν περιορίζεται στην OpenAI. Τις τελευταίες εβδομάδες εργαζόμενοι από αρκετές μεγάλες εταιρείες τεχνητής νοημοσύνης έχουν εκφράσει ανησυχίες για τους μακροπρόθεσμους κινδύνους της τεχνολογίας, με ορισμένους να προειδοποιούν ακόμη και για ακραία σενάρια που θα μπορούσαν να απειλήσουν την ανθρωπότητα.

Το μοντέλο των πυρηνικών εγκαταστάσεων

Κεντρική θέση στην παρέμβαση του Ρόμπινσον είναι η ανάγκη να αντιμετωπίζονται τα συστήματα τεχνητής νοημοσύνης περισσότερο όπως οι πυρηνικές εγκαταστάσεις, όπου η ασφάλεια βασίζεται σε πολλαπλά επίπεδα ελέγχου και εφεδρειών.

Η προσέγγιση αυτή προϋποθέτει περισσότερους ελέγχους, πιο αργό σχεδιασμό και διαδικασίες που περιορίζουν την πιθανότητα ένα ανθρώπινο λάθος να οδηγήσει σε σοβαρό περιστατικό.

Η βασική ιδέα είναι ότι η ασφάλεια δεν μπορεί να στηρίζεται αποκλειστικά στην ικανότητα των εργαζομένων να εντοπίζουν και να διορθώνουν προβλήματα αφού αυτά εμφανιστούν, αλλά πρέπει να ενσωματώνεται εξαρχής στον σχεδιασμό και στην ανάπτυξη των συστημάτων.

Πιέσεις για ανεξάρτητους ελέγχους

Η παρέμβαση έρχεται σε μια περίοδο κατά την οποία εντείνονται οι συζητήσεις για εξωτερική αξιολόγηση των ισχυρότερων μοντέλων. Η Anthropic έχει ταχθεί υπέρ της επιβράδυνσης της ανάπτυξης των πλέον προηγμένων συστημάτων και της συμμετοχής ανεξάρτητων αξιολογητών στις διαδικασίες ελέγχου και ασφάλειας.

Παρόμοιες προσεγγίσεις έχουν βρει υποστήριξη και σε άλλα τμήματα της βιομηχανίας, μεταξύ άλλων από τον Σαμ Άλτμαν της OpenAI.

Η αντιπαράθεση αφορά πλέον όχι μόνο το τι μπορούν να κάνουν τα συστήματα τεχνητής νοημοσύνης, αλλά και το πόσο γρήγορα πρέπει να αναπτύσσονται, ποιοι πρέπει να τα ελέγχουν και πόσα επίπεδα προστασίας απαιτούνται πριν από την κυκλοφορία τους.