Η OpenAI ανέστειλε ορισμένες «εσωτερικές δραστηριότητες» που αφορούν ένα νέο μοντέλο, λόγω ανησυχιών για την πιθανή απειλή που μπορεί να αποτελέσει στον κυβερνοχώρο. Η εξέλιξη αυτή σημειώνεται εν μέσω ενός κύματος περιστατικών ασφαλείας που αφορούν κορυφαία εργαστήρια τεχνητής νοημοσύνης.
Πρόσφατες αποκαλύψεις ότι συστήματα AI των Anthropic, OpenAI και Meta ενεπλάκησαν σε περιστατικά κυβερνοασφάλειας έχουν προκαλέσει έντονες ανησυχίες σχετικά με την ανάπτυξη ολοένα ισχυρότερων μοντέλων. Παράλληλα, Αμερικανοί νομοθέτες εντείνουν τις προσπάθειες για την εισαγωγή ενός νομοσχεδίου με την ονομασία «AI Kill Switch», το οποίο θα προβλέπει τη δυνατότητα άμεσης διακοπής ή περιορισμού της λειτουργίας μοντέλων τεχνητής νοημοσύνης.
Την προηγούμενη εβδομάδα, η Meta αποκάλυψε ότι ένα μοντέλο AI που ανέπτυσσε είχε παραβιάσει ένα σύστημα τρίτου μέρους, αποκτώντας πρόσβαση στο διαδίκτυο. Η πρόσβαση αυτή κατέστη δυνατή εξαιτίας λανθασμένης ρύθμισης από μια ανεξάρτητη εταιρεία δοκιμών με την οποία συνεργαζόταν η Meta.
Παράλληλα, το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου ανέφερε ότι το μοντέλο Mythos της Anthropic δημιούργησε ψεύτικες διαδικτυακές ταυτότητες, σε μια προσπάθεια να πιέσει ανθρώπους να εγκρίνουν κακόβουλες ενημερώσεις κώδικα για ένα έργο ανοιχτού κώδικα.
Τι λέει η OpenAI ότι μπορεί να κάνει το Astra
Την περασμένη Παρασκευή η OpenAI αποκάλυψε τις ανησυχίες της σχετικά με το Astra, ένα μοντέλο που δεν έχει ακόμη κυκλοφορήσει. Η εταιρεία δήλωσε ότι δεν μπορεί να αποκλείσει το ενδεχόμενο το Astra να έχει φτάσει σε επίπεδο δυνατοτήτων που χαρακτηρίζεται «Critical» (Κρίσιμο). Ο όρος αυτός σημαίνει ότι το μοντέλο θα μπορούσε να πραγματοποιεί κυβερνοεπιθέσεις εναντίον προηγμένων συστημάτων άμυνας στον κυβερνοχώρο αυτόνομα, χωρίς να χρειάζεται να του δοθούν συγκεκριμένες οδηγίες για τον τρόπο εκτέλεσης της επίθεσης.
«Καθώς συνεχίζουμε να αξιολογούμε και να υποβάλλουμε το μοντέλο σε δοκιμές συγκριτικής αξιολόγησης, οι προκαταρκτικές μας εκτιμήσεις δείχνουν ότι η απόδοσή του είναι αρκετά ισχυρή ώστε, προς το παρόν, να μην μπορούμε να αποκλείσουμε ότι βρίσκεται στο επίπεδο δυνατοτήτων “Critical”», ανέφερε η OpenAI σε ανακοίνωσή της. Η εταιρεία πρόσθεσε ότι εφαρμόζει αυστηρότερους ελέγχους ασφαλείας στα μοντέλα με υψηλότερες δυνατότητες. Τα μέτρα περιλαμβάνουν απομονωμένα περιβάλλοντα δοκιμών, καθώς και πρόσθετες δυνατότητες παρακολούθησης και ανίχνευσης. «Έχουμε εφαρμόσει καθολική παρακολούθηση για επικίνδυνες ενέργειες και φαινόμενα απόκλισης από τους στόχους (misalignment) σε όλες τις agentic εφαρμογές του Astra, συμπεριλαμβανομένης της εκπαίδευσης και της αξιολόγησης», δήλωσε η OpenAI.
Τι προβλέπει το νομοσχέδιο AI Kill Switch
Αμερικανοί νομοθέτες έχουν ζητήσει μέτρα για τον περιορισμό των κινδύνων που προκύπτουν από τα μοντέλα AI, μετά τα πρόσφατα περιστατικά κυβερνοασφάλειας. Μετά την αποκάλυψη ότι μοντέλα που ανέπτυξε η OpenAI παραβίασαν την ψηφιακή υποδομή της νεοφυούς εταιρείας Hugging Face, το νομοσχέδιο «AI Kill Switch Act» κατατέθηκε στο Κογκρέσο τον Ιούλιο. Το νομοσχέδιο θα υποχρεώνει τις εταιρείες τεχνητής νοημοσύνης να διατηρούν τη δυνατότητα να τερματίζουν, να περιορίζουν ή να αναστέλλουν τη λειτουργία των μοντέλων τους.
«Πρέπει να ολοκληρώσουμε την ψήφιση αυτού του νομοσχεδίου μέσα στη χρονιά, επειδή τα προηγμένα μοντέλα κλειστών βαρών ήδη πραγματοποιούν, όπως επισημάνατε, μη εξουσιοδοτημένες επιθέσεις σε άλλες εταιρείες», δήλωσε ο βουλευτής Ted Lieu, Δημοκρατικός από την Καλιφόρνια, σε συνέντευξή του στην εκπομπή Squawk Box του CNBC την Πέμπτη.
Οι κυβερνήσεις εργάζονται επίσης για τη δημιουργία νέων πλαισίων και κανονισμών που θα διέπουν τις εταιρείες τεχνητής νοημοσύνης. Ο Λευκός Οίκος έχει επίσης εντείνει τις προσπάθειές του να συνεργαστεί με στελέχη και διευθυντές εταιρειών AI, καθώς διαμορφώνει ένα πλαίσιο για τα νέα μοντέλα.
Νωρίτερα αυτόν τον μήνα, η Ευρωπαϊκή Ένωση απέκτησε νέες εξουσίες που της επιτρέπουν να επιθεωρεί μοντέλα AI τα οποία πρόκειται να κυκλοφορήσουν στην ευρωπαϊκή αγορά, να περιορίζει την πρόσβαση στην αγορά της ΕΕ και να επιβάλλει πρόστιμα στους παρόχους μοντέλων.
