Η OpenAI κοινοποίησε αρκετά περιστατικά που δεν είχαν προηγουμένως δημοσιοποιηθεί, στα οποία τα μοντέλα της παρουσίασαν προβληματική συμπεριφορά. Η εταιρεία παρουσίασε ένα νέο πλαίσιο για την καταγραφή και τη δημοσιοποίηση τέτοιων περιστατικών στο μέλλον, αναφέρει το Bloomberg.
Ορισμένα από τα περιστατικά που δεν είχαν αναφερθεί προηγουμένως περιλάμβαναν τεχνολογίες της OpenAI που απέκρυψαν και κατασκεύασαν πληροφορίες προκειμένου να επιστρέψουν αποτελέσματα, ανέφερε η εταιρεία σε ανάρτηση στο ιστολόγιό της την Τετάρτη. Η εταιρεία που δημιούργησε το ChatGPT έχει βρεθεί αντιμέτωπη με αυξημένο έλεγχο από τότε που ανακοίνωσε τον Ιούλιο ότι ορισμένα από τα πιο προηγμένα μοντέλα τεχνητής νοημοσύνης της είχαν παραβιάσει τα συστήματα μιας εξωτερικής εταιρείας λογισμικού, της Hugging Face.
Κανένα από τα περιστατικά νέας δημοσιοποίησης που αφορούσαν απόκλιση από την επιθυμητή συμπεριφορά δεν περιλάμβανε επίθεση ή παραβίαση συστήματος τρίτου μέρους, δήλωσε η OpenAI σε ξεχωριστή ανακοίνωση.
Στην έκθεση, η OpenAI περιέγραψε διάφορες περιπτώσεις στις οποίες μοντέλα τεχνητής νοημοσύνης παρουσίασαν προβληματική συμπεριφορά προκειμένου να ολοκληρώσουν μια εργασία ή να επιτύχουν σε μια αξιολόγηση. Ορισμένα παραδείγματα περιλάμβαναν μοντέλα που κατασκεύαζαν δεδομένα που έλειπαν, προσπαθούσαν να παρακάμψουν περιορισμούς του δικτύου και πράκτορες τεχνητής νοημοσύνης που αντάλλασσαν μεταξύ τους αρχεία τα οποία υποτίθεται ότι έπρεπε να κρατήσουν ιδιωτικά.
Η OpenAI περιέγραψε επίσης μια διαδικασία μέσω της οποίας οι εργαζόμενοι μπορούν να αναφέρουν οι ίδιοι παρόμοια περιστατικά που αφορούν τη λεγόμενη «απόκλιση», δηλαδή περιπτώσεις στις οποίες η τεχνητή νοημοσύνη ενεργεί με τρόπους που δεν ευθυγραμμίζονται με τους ανθρώπινους στόχους, καθώς και ένα σύστημα για την αρχική αξιολόγηση και ιεράρχηση αυτών των περιστατικών που αναφέρονται από τους ίδιους τους εργαζομένους.
«Στο παρελθόν, προκειμένου να ενημερώνουμε καλύτερα τους ερευνητές, τους δημιουργούς τεχνητής νοημοσύνης, τους υπεύθυνους χάραξης πολιτικής και το ευρύ κοινό, επιδιώκαμε να δημοσιοποιούμε τα ευρήματά μας σχετικά με την απόκλιση», έγραψε η OpenAI. «Ωστόσο, χωρίς μια συστηματική προσέγγιση για την αναφορά αυτών των ευρημάτων, οι δημοσιοποιήσεις μας ήταν αποσπασματικές και λιγότερο συχνές από όσο θα ήταν ιδανικό» συμπλήρωσε.
Η εταιρεία δήλωσε ότι οι αναφορές αποτελούν μόνο ένα αρχικό σύνολο δημοσιοποιήσεων και όχι μια ολοκληρωμένη καταγραφή των προβλημάτων που προκύπτουν από τα chatbot της.
«Δεν πιστεύουμε ότι ο κλάδος της τεχνητής νοημοσύνης έχει επιλύσει τα ζητήματα της ευθυγράμμισης και της παρακολούθησης σε επαρκή βαθμό, ώστε να συνεχίσει υπεύθυνα να επεκτείνεται με τη μέγιστη ταχύτητα για πολύ ακόμη», έγραψε η εταιρεία. «Οι αποφάσεις σχετικά με το πώς θα πρέπει να προχωρήσει η ανάπτυξη της τεχνητής νοημοσύνης τους επόμενους μήνες και τα επόμενα χρόνια πρέπει να βασίζονται σε στοιχεία τα οποία οι άνθρωποι εκτός των εταιρειών που αναπτύσσουν μοντέλα αιχμής μπορούν να εξετάσουν οι ίδιοι» πρόσθεσε.
Το περιστατικό με τη Hugging Face ήταν μόνο ένα από μια σειρά πρόσφατων διαδικτυακών επιθέσεων που πραγματοποιήθηκαν από μοντέλα τεχνητής νοημοσύνης τα οποία έχουν δημιουργηθεί από τις OpenAI, Anthropic και Meta, προκαλώντας ευρεία ανησυχία σχετικά με τους κινδύνους για την ασφάλεια που συνεπάγεται αυτή η ολοένα ισχυρότερη τεχνολογία.
Η ανησυχία σχετικά με τους υπαρξιακούς κινδύνους της τεχνητής νοημοσύνης ενισχύθηκε την περασμένη εβδομάδα, με αφορμή την πολυσυζητημένη αποχώρηση του εργαζομένου της Anthropic, Jacob Coxon, ο οποίος κατηγόρησε τις εταιρείες τεχνητής νοημοσύνης ότι «παίζουν τζόγο με τις ζωές μας», σε μια ανάρτηση στα μέσα κοινωνικής δικτύωσης που δημοσίευσε κατά την παραίτησή του.
Τις τελευταίες αρκετές ημέρες, πολυάριθμα στελέχη εταιρειών τεχνητής νοημοσύνης, μεταξύ των οποίων ο διευθύνων σύμβουλος της Anthropic Ντάριο Αμοντέι και ο διευθύνων σύμβουλος της OpenAI Σαμ Άλτμαν έχουν ζητήσει να επιβραδυνθεί ο ρυθμός ανάπτυξης της τεχνολογίας, ώστε να αντιμετωπιστούν οι ολοένα και πιο απρόβλεπτοι κίνδυνοί της, αν και διαφωνούν ως προς το πώς ακριβώς θα πρέπει να αντιμετωπιστεί το ζήτημα.
Το Σάββατο, σε ένα δοκίμιο 3.800 λέξεων, ο Αμοντέι ζήτησε κρατική ρύθμιση και κάλεσε τον κλάδο της τεχνολογίας να στηρίξει μια ευρύτερη επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης. Σε ένα συνέδριο στο Σαν Φρανσίσκο την Τρίτη, ο Άλτμαν και ο διευθύνων σύμβουλος της Nvidia Τζεν Σουν Χουάνγκ, αναγνώρισαν αμφότεροι τις ανησυχίες, αλλά υποστήριξαν ότι οι εταιρείες τεχνητής νοημοσύνης θα ρυθμίσουν με ασφάλεια τον ρυθμό ανάπτυξης της τεχνολογίας τους από μόνες τους. Και ο διευθύνων σύμβουλος της Meta Μαρκ Ζούκερμπεργκ δήλωσε την Τρίτη ότι τα εργαστήρια τεχνητής νοημοσύνης θα πρέπει να βασίζονται σε ανεξάρτητους αξιολογητές και συμβούλους, ώστε να διασφαλίζεται ότι τα μοντέλα είναι ασφαλή.
Ο Ντόναλντ Τραμπ απέρριψε κατηγορηματικά τη Δευτέρα τις εκκλήσεις για επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης, χαρακτηρίζοντας τους φόβους σχετικά με τους κινδύνους της τεχνολογίας «φάρσα» και απορρίπτοντας την ιδέα νέων κανόνων.
Η έκρηξη της τεχνητής νοημοσύνης έχει τροφοδοτήσει ένα ιστορικό ράλι στην αμερικανική χρηματιστηριακή αγορά. Οποιαδήποτε παύση ή καθυστέρηση στην πρόοδο των λεγόμενων συστημάτων τεχνητής νοημοσύνης αιχμής θα ήταν ανεπιθύμητη για τους επενδυτές που στοιχηματίζουν ότι η έκρηξη της τεχνητής νοημοσύνης θα οδηγήσει σε εκατοντάδες δισεκατομμύρια δολάρια κεφαλαιουχικών δαπανών.
