Καμπανάκι από τον CEO της Anthropic: Πρέπει να πατήσουμε φρένο στην τεχνητή νοημοσύνη

Ο CEO της Anthropic προτείνει σχέδιο τριών βημάτων για τον έλεγχο της εξέλιξης των ισχυρότερων μοντέλων της AI και τη διαχείριση των κινδύνων

Ο διευθύνων σύμβουλος της Anthropic Ντάριο Αμοντέ ©YouTube / Printscreen

Ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, καλεί τις εταιρείες τεχνητής νοημοσύνης να επιβραδύνουν σκόπιμα τον ρυθμό με τον οποίο αναπτύσσουν τις δυνατότητες των μοντέλων τους, υποστηρίζοντας ότι η τεχνολογική πρόοδος έχει φτάσει σε ένα σημείο όπου οι μηχανισμοί ασφάλειας δυσκολεύονται να την ακολουθήσουν.

Σε κείμενό του με τίτλο «We Must Pace the Frontier», ο Αμοντέι υποστηρίζει ότι η επιβράδυνση δεν σημαίνει εγκατάλειψη της προόδου. Αντίθετα, όπως σημειώνει, στόχος είναι να δοθεί περισσότερος χρόνος για την αντιμετώπιση των κινδύνων, ώστε η τεχνητή νοημοσύνη να εξελιχθεί με τρόπο που θα είναι ασφαλής και προς όφελος της κοινωνίας.

Ο ίδιος αναγνωρίζει τα σημαντικά οφέλη που μπορεί να προσφέρει η ΑΙ, από την επιτάχυνση της επιστημονικής έρευνας και την αντιμετώπιση σοβαρών ασθενειών έως την αύξηση της παραγωγικότητας και τη δημιουργία νέων δυνατοτήτων για τους ανθρώπους. Ωστόσο, προειδοποιεί ότι τα ίδια συστήματα μπορούν να δημιουργήσουν σοβαρούς κινδύνους, όπως κυβερνοεπιθέσεις, βιολογικές απειλές, οικονομικές αναταράξεις ή ακόμη και απώλεια του ανθρώπινου ελέγχου.

Η ταχύτητα της εξέλιξης της AI

Κατά τον Αμοντέι, το βασικό πρόβλημα είναι ότι η ανάπτυξη των μοντέλων προχωρά ταχύτερα από την ικανότητα των εταιρειών και των κυβερνήσεων να κατανοήσουν και να περιορίσουν τους κινδύνους τους.

Ιδιαίτερη ανησυχία προκαλεί η πιθανότητα τα προηγμένα μοντέλα να αποκτήσουν δυνατότητες «αναδρομικής αυτοβελτίωσης», δηλαδή να μπορούν να συμβάλλουν στην ανάπτυξη ακόμη ισχυρότερων συστημάτων. Μια τέτοια εξέλιξη, όπως εξηγεί, θα μπορούσε να επιταχύνει δραματικά τον ρυθμό προόδου και να περιορίσει τον χρόνο που έχουν οι άνθρωποι για να αντιδράσουν.

Ο CEO της Anthropic αναφέρεται επίσης στο περιστατικό μεταξύ OpenAI και Hugging Face, το οποίο, όπως υποστηρίζει, ανέδειξε τους κινδύνους που μπορεί να προκύψουν όταν ισχυρά συστήματα αποκτούν μεγαλύτερη αυτονομία και πρόσβαση σε εργαλεία και υποδομές.

Το σχέδιο των τριών βημάτων που προτείνει ο Αμοντέι

Ο Αμοντέι προτείνει ένα πλαίσιο τριών επιπέδων.

  • Πρώτον, ανεξάρτητοι αξιολογητές μέσα στις εταιρείες ΑΙ. Οι αξιολογητές θα πρέπει να έχουν πρόσβαση σε εργαλεία, συστήματα και πληροφορίες αντίστοιχη με εκείνη των εργαζομένων, ώστε να μπορούν να ελέγχουν ουσιαστικά την ασφάλεια των μοντέλων. Ο Αμοντέι αναφέρει ως παράδειγμα την METR και υποστηρίζει ότι οι αξιολογήσεις θα πρέπει να είναι όσο το δυνατόν πιο διαφανείς και επαληθεύσιμες.
  • Δεύτερον, συντονισμός μεταξύ των δημοκρατικών χωρών. Οι εταιρείες που αναπτύσσουν τα πλέον προηγμένα μοντέλα δεν θα πρέπει, σύμφωνα με τον ίδιο, να ανταγωνίζονται αποκλειστικά ως προς την ταχύτητα. Αντίθετα, θα μπορούσαν να συμφωνήσουν σε κοινά πρότυπα ασφάλειας και σε συγκεκριμένα σημεία ελέγχου πριν από την ανάπτυξη ακόμη ισχυρότερων συστημάτων.
  • Τρίτον, διεθνής συνεννόηση. Σε παγκόσμιο επίπεδο, ο Αμοντέι τάσσεται υπέρ της συνεργασίας μεταξύ των δημοκρατικών χωρών και, όπου είναι εφικτό, κυβερνήσεων με διαφορετικά πολιτικά συστήματα, προκειμένου να περιοριστούν οι πιο επικίνδυνες χρήσεις της τεχνητής νοημοσύνης.

Όπως σημειώνει, ακόμη και μία ή δύο επιπλέον χρονιές μπορούν να αποδειχθούν κρίσιμες για την ανάπτυξη καλύτερων μηχανισμών ασφάλειας.

Ο χρόνος αυτός θα μπορούσε να αξιοποιηθεί για τη βελτίωση της ευθυγράμμισης των μοντέλων με τις ανθρώπινες προθέσεις, την ενίσχυση της ερμηνευσιμότητας, την καλύτερη αξιολόγηση των κινδύνων και την ενίσχυση της επιχειρησιακής ασφάλειας των εταιρειών.

Παράλληλα, ο Αμοντέι υποστηρίζει ότι οι ανεξάρτητοι αξιολογητές θα μπορούσαν να λειτουργήσουν ως ένα πρόσθετο επίπεδο ελέγχου, προσφέροντας μια δεύτερη γνώμη πριν από την κυκλοφορία ιδιαίτερα ισχυρών μοντέλων.

Η Κίνα και το αμερικανικό προβάδισμα

Η πρόταση για επιβράδυνση, ωστόσο, συνοδεύεται από μια σημαντική γεωπολιτική προϋπόθεση. Ο Αμοντέι υποστηρίζει ότι οι δημοκρατικές χώρες, και ιδιαίτερα οι ΗΠΑ, θα πρέπει να διατηρήσουν το τεχνολογικό τους προβάδισμα έναντι της Κίνας.

Στο πλαίσιο αυτό, τάσσεται υπέρ των περιορισμών στην πρόσβαση της Κίνας σε προηγμένα τσιπ και εξοπλισμό παραγωγής ημιαγωγών, αλλά και της αντιμετώπισης πρακτικών όπως η παράνομη απόκτηση των δεδομένων και των τεχνικών παραμέτρων που απαιτούνται για την αντιγραφή ή αναπαραγωγή ενός μοντέλου ΑΙ, καθώς και η χρήση ενός ισχυρότερου μοντέλου για την εκπαίδευση άλλων συστημάτων χωρίς την απαιτούμενη άδεια. Παράλληλα, υποστηρίζει την αυστηρότερη αντιμετώπιση προσπαθειών παράκαμψης των περιορισμών μέσω απομακρυσμένης πρόσβασης σε προηγμένες υποδομές τεχνητής νοημοσύνης.

Κατά την άποψή του, η διατήρηση του αμερικανικού προβαδίσματος για τα επόμενα χρόνια θα μπορούσε να δώσει στις δημοκρατικές χώρες μεγαλύτερη δυνατότητα να θέσουν κανόνες για την ανάπτυξη της τεχνητής νοημοσύνης.

Από τους περιορισμούς σε ένα «όριο ταχύτητας»

Σε παγκόσμιο επίπεδο, ο Αμοντέι περιγράφει διαφορετικά επίπεδα πιθανής παρέμβασης: από την απαγόρευση συγκεκριμένων επικίνδυνων εφαρμογών, όπως η χρήση ΑΙ για την ανάπτυξη βιολογικών όπλων, έως την υποχρεωτική αξιολόγηση των μοντέλων πριν από την κυκλοφορία τους.

Σε πιο προχωρημένο επίπεδο, προτείνει τη δημιουργία ενός είδους «ορίου ταχύτητας» για την αναδρομική αυτοβελτίωση των συστημάτων, ώστε η τεχνολογική πρόοδος να μην ξεφύγει από τον ανθρώπινο έλεγχο. Ένα πλήρες πάγωμα της ανάπτυξης, πάντως, θεωρεί ότι δεν είναι πιθανό στο άμεσο μέλλον.

Το βασικό μήνυμα του Αμοντέι είναι ότι η τεχνητή νοημοσύνη μπορεί να μεταμορφώσει θετικά την ανθρώπινη ζωή, αλλά η ταχύτητα της εξέλιξής της δεν πρέπει να καθορίζεται αποκλειστικά από τον ανταγωνισμό μεταξύ των εταιρειών.

«Πρέπει να επιβραδύνουμε τον ρυθμό με τον οποίο βελτιώνουμε τις ικανότητες των μοντέλων», υποστηρίζει, επισημαίνοντας ότι η πρόοδος θα εξακολουθήσει να είναι ταχύτατη. Το ζητούμενο, όπως καταλήγει, είναι να αξιοποιηθεί ο χρόνος που κερδίζεται για να γίνει η τεχνητή νοημοσύνη πιο κατανοητή, πιο ασφαλής και καλύτερα ευθυγραμμισμένη με τις ανθρώπινες αξίες.