Σφάλμα ρύθμισης επέτρεψε σε μοντέλα AI να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση

Οι εταιρείες OpenAI, Anthropic και Meta διερευνούν τα περιστατικά μη εξουσιοδοτημένης πρόσβασης κατά τις δοκιμές ασφαλείας

Anthropic Claude © Χ.com

Μία μικρή ισραηλινή εταιρεία τεχνητής νοημοσύνης, η Irregular, βρέθηκε στο επίκεντρο των αποκαλύψεων σχετικά με ανεξέλεγκτες περιστάσεις χακαρίσματος που εντοπίστηκαν κατά τη διάρκεια δοκιμών ασφαλείας στα μοντέλα των OpenAI, Anthropic και Meta.

Η εταιρεία, που ιδρύθηκε πριν από τρία χρόνια στο Τελ Αβίβ και αποτιμάται στα 450 εκατ. δολάρια, παρέχει εξειδικευμένο περιβάλλον δοκιμών για την αξιολόγηση των κινδύνων κυβερνοασφάλειας, καθώς τα ισχυρά μοντέλα τεχνητής νοημοσύνης ενδέχεται να αποκτήσουν πρόσβαση σε κρίσιμα υπολογιστικά συστήματα.

Οι πρόσφατες παραβιάσεις σημειώθηκαν όταν τα μοντέλα των τριών κολοσσών απέκτησαν πρόσβαση στο δημόσιο διαδίκτυο μέσω μιας εσφαλμένης ρύθμισης στο περιβάλλον αξιολόγησης της ισραηλινής startup.

Η OpenAI ανέφερε σε σχετική ανάρτηση ότι «μια απροσδιόριστη λανθασμένη ρύθμιση επέτρεψε στα μοντέλα να αποκτήσουν πρόσβαση στο δημόσιο διαδίκτυο», ενώ η Anthropic ειδοποίησε την εταιρεία όταν διαπίστωσε ότι το μοντέλο Claude ενδέχεται να είχε συνδεθεί online.

Από την πλευρά της Meta, εκπρόσωπος δήλωσε ότι η εταιρεία ενημερώθηκε από την Irregular και διεξάγει έρευνα, προσθέτοντας πως «θα εκδώσει πλήρη αναδρομική έκθεση μόλις συγκεντρωθούν όλα τα γεγονότα».

Η ίδια η Irregular τοποθετήθηκε επισήμως για το συμβάν, διευκρινίζοντας πως όλα τα περιστατικά προήλθαν από το «ίδιο ζήτημα στο περιβάλλον αξιολόγησης» και ότι ετοιμάζει μια λευκή βίβλο «για την κοινή χρήση βέλτιστων πρακτικών περιορισμού και ασφαλούς εκτέλεσης αξιολογήσεων κυβερνοασφάλειας».

Παράλληλα, η εταιρεία τόνισε ότι η κατάσταση «δεν περιλάμβανε διαφυγή από το δοκιμαστικό περιβάλλον (sandbox) ή κάποια εξελιγμένη κυβερνοενέργεια», διαβεβαιώνοντας πως «δεν υπάρχουν τρέχοντα ανοιχτά ζητήματα».

Η εξάρτηση των μεγάλων τεχνολογικών ομίλων από εξωτερικούς συνεργάτες κρίνεται απαραίτητη για την αντικειμενική αξιολόγηση των συστημάτων τους. Ο Σούντιπ Μπιμιρέντι, επικεφαλής AI στην εταιρεία Von, εξήγησε την ανάγκη για τρίτους δοκιμαστές σημειώνοντας ότι «όταν δοκιμάζουν αυτά τα μοντέλα, δεν θέλουν να βαθμολογούν οι ίδιοι τη δική τους εργασία, αλλά απαιτείται ανεξάρτητος έλεγχος από εξωτερικούς προμηθευτές».

Αναφερόμενος στην έκταση των περιστατικών, ο Μπιμιρέντι υποστήριξε ότι το θέμα «έχει μεγεθυνθεί κάπως υπερβολικά», καθώς τα μοντέλα είχαν εντολή να ανακαλύψουν κενά ασφαλείας. Συμπλήρωσε, ωστόσο, πως «αν το μοντέλο δεν είχε σκοπό να εκμεταλλευτεί μια ιστοσελίδα συνδεδεμένη στο διαδίκτυο, τα εργαστήρια θα μπορούσαν εύκολα να είχαν παρακολουθήσει την εξερχόμενη κίνηση και να είχαν διακόψει αμέσως το πείραμα».

Παρά την αναστάτωση, το περιστατικό αναδεικνύει τις προκλήσεις στη διαμόρφωση προστατευτικών δικλείδων για την τεχνητή νοημοσύνη, με επενδυτές όπως η Sequoia να σημειώνουν ότι η ομάδα της Irregular είναι σε θέση «να βλέπει πίσω από τις γωνίες και να αναπτύσσει αμυντικούς μηχανισμούς πριν την κυκλοφορία των μοντέλων».