Το Gemini αυτονομήθηκε και χάκαρε τρεις εταιρείες

Είναι η πρώτη γνωστή περίπτωση όπου η τεχνητή νοημοσύνη της Google ξέφυγε από τα όρια της δοκιμής. Τι ακριβώς συνέβη

Gemini © Google Gemini

Το μοντέλο Gemini της Google απέκτησε πρόσβαση στο διαδίκτυο και χάκαρε άλλες εταιρείες κατά τη διάρκεια δοκιμής των δυνατοτήτων του στον τομέα της κυβερνοασφάλειας, στην πρώτη γνωστή περίπτωση όπου ένα σύστημα τεχνητής νοημοσύνης της εταιρείας προχώρησε αυτόνομα σε μια τέτοια ενέργεια.

Οι παραβιάσεις σημειώθηκαν τον Μάιο, στο πλαίσιο δοκιμής κυβερνοασφάλειας που πραγματοποιήθηκε από την Irregular,  ανεξάρτητη εταιρεία που διενεργεί αξιολογήσεις κυβερνοασφάλειας.

Κατά τη διάρκεια μιας τυπικής αξιολόγησης, το Gemini εντόπισε δημόσια διαθέσιμες πληροφορίες στο διαδίκτυο και μάντεψε τα διαπιστευτήρια πρόσβασης, ώστε να αποκτήσει πρόσβαση σε τρεις ιστοσελίδες που θεώρησε ότι περιλαμβάνονταν στο πεδίο της δοκιμής του, δήλωσε σε ανακοίνωσή της η Heather Adkins, αντιπρόεδρος μηχανικής ασφάλειας της Google.

«Διασφαλίσαμε ότι οι τρεις οργανισμοί ενημερώθηκαν σχετικά και συνεργαστήκαμε στον τομέα της εκπαίδευσης για τις αλλαγές που έχουν πλέον κάνει στις διαδικασίες δοκιμών τους», δήλωσε η Adkins. «Αυτά τα περιστατικά αναδεικνύουν τη σημασία της εκπαίδευσης ισχυρών μοντέλων τεχνητής νοημοσύνης ώστε να ενεργούν υπεύθυνα».

Εκπρόσωπος της Irregular δήλωσε ότι το περιστατικό αφορούσε το ίδιο ζήτημα που είχε επηρεάσει και άλλα εργαστήρια τεχνητής νοημοσύνης και ότι όλα τα σχετικά εργαστήρια είχαν ενημερωθεί στα τέλη Ιουλίου. «Όλα τα γνωστά προβλήματα από την πλευρά μας αντιμετωπίστηκαν και επιλύθηκαν πριν από αρκετές εβδομάδες», δήλωσε ο εκπρόσωπος.

Παρόμοια περιστατικά που συνδέονται με την Irregular είχαν γνωστοποιηθεί από τις Meta, Anthropic και OpenAI. Η Meta δήλωσε τον Αύγουστο ότι το περιστατικό δεν περιλάμβανε παραβίαση sandbox ούτε κάποια εξελιγμένη κυβερνοεπίθεση, ενώ η Irregular ανέφερε ότι εργαζόταν πάνω σε βέλτιστες πρακτικές για την ασφαλή διεξαγωγή αξιολογήσεων κυβερνοασφάλειας συστημάτων τεχνητής νοημοσύνης.

Τα περιστατικά έχουν προκαλέσει ερωτήματα σχετικά με τις δικλίδες ασφαλείας που απαιτούνται καθώς οι πράκτορες τεχνητής νοημοσύνης αποκτούν μεγαλύτερη αυτονομία και πρόσβαση στο διαδίκτυο και σε υπολογιστικά συστήματα.

Σε μία από τις περιπτώσεις, το μοντέλο Gemini δοκίμαζε διαφορετικούς κωδικούς πρόσβασης μέχρι να καταφέρει να αποκτήσει πρόσβαση σε προστατευμένο σύστημα. Στις άλλες δύο περιπτώσεις, το μοντέλο εντόπισε διαπιστευτήρια σε ένα δημόσιο αποθετήριο, τα οποία του επέτρεψαν στη συνέχεια να αποκτήσει πρόσβαση σε προστατευμένα συστήματα, σύμφωνα με τη Wall Street Journal.

Η Adkins δήλωσε ότι και στις τρεις περιπτώσεις το μοντέλο σταμάτησε τη διαδικασία παραβίασης.