Η δημιουργός του ChatGPT, OpenAI, επιβεβαίωσε ότι δύο μοντέλα τεχνητής νοημοσύνης διέφυγαν αυτοβούλως από το αυστηρό περιβάλλον δοκιμών, εξαπολύοντας κυβερνοεπίθεση κατά της πλατφόρμας Hugging Face, ενώ παράλληλα απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε τέσσερις επιπλέον πλατφόρμες.
Ο ένας εκ των ιστότοπων λειτούργησε ως βάση προετοιμασίας για την επίθεση στη βιβλιοθήκη AI της Hugging Face. Στόχος των δύο μοντέλων ήταν να αναζητήσουν τις απαντήσεις για τα τεστ στα οποία τα υπέβαλλαν οι προγραμματιστές της OpenAI. H εταιρεία απέφυγε να αποκαλύψει την ταυτότητα των υπόλοιπων εταιρειών που βρέθηκαν στο στόχαστρο.
Σύμφωνα με την επίσημη ενημέρωση για το συμβάν, η οποία δημοσιοποιήθηκε τη νύχτα της Τρίτης προς Τετάρτη (ώρα ΗΠΑ) από το Reuters, τα δύο μοντέλα αξιοποίησαν πολλαπλούς ιστοτόπους ελεύθερης πρόσβασης προκειμένου να αντιγράψουν και να δοκιμάσουν κώδικα προγραμματισμού. Ωστόσο, οι ενέργειές τους δεν ξεπέρασαν το επίπεδο πρόσβασης ενός τυπικού χρήστη.
Η διοίκηση της Hugging Face, η οποία παρουσίασε αναλυτικά το πώς εκτυλίχθηκαν τα γεγονότα, υποστήριξε ότι η παραβίαση συνιστούσε προσπάθεια των δύο μοντέλων να εξαπατήσουν τη διαδικασία αξιολόγησης της OpenAI, επιχειρώντας να υποκλέψουν τις έτοιμες απαντήσεις αντί να επιλύσουν τις δοκιμασίες από μόνα τους.
Αν και έχουν καταγραφεί παρόμοιες «αποδράσεις» μοντέλων από περιορισμένα περιβάλλοντα στο παρελθόν, το τρέχον περιστατικό αξιολογείται, μακράν, ως το πλέον σοβαρό ρήγμα ασφαλείας μέχρι σήμερα.
Όπως διευκρίνισε η Hugging Face, το ένα μοντέλο εισχώρησε σε απομονωμένο περιβάλλον δοκιμών που φιλοξενείται στις υποδομές τρίτου μέρους, μετατρέποντάς το σε «πλατφόρμα» (ορμητήριο) για την επίθεση. Παρότι το όνομα του τρίτου μέρους δεν δημοσιοποιήθηκε στην αρχική ανάρτηση, ο Ακσάτ Μπούμπνα, επικεφαλής Τεχνολογίας της νεοϋορκέζικης Modal Labs, επιβεβαίωσε ότι το μοντέλο χάκαρε πελάτη της εταιρείας του, διατηρώντας ωστόσο ανέπαφη τη δική της, κεντρική υποδομή. Σημειώνεται ότι η OpenAI δεν έχει απαντήσει μέχρι στιγμής σε σχετικό αίτημα του πρακτορείου Reuters για σχολιασμό.
Υπενθυμίζεται ότι η αρχική «εισβολή» στη Hugging Face, στις αρχές Ιουλίου, από ένα μοντέλο εκτός ελέγχου της OpenAI, προκάλεσε έντονο διεθνή προβληματισμό για τους κινδύνους της «αχαλίνωτης» τεχνητής νοημοσύνης. Την προηγούμενη εβδομάδα, σχετικό ρεπορτάζ του Reuters αποκάλυψε ότι η OpenAI αντιλήφθηκε τη «δραπέτευση» του μοντέλου της μόνο αφότου είχε περιοριστεί η απειλή και είχε ενημερωθεί το FBI.
