Ο Dario Amodei προειδοποιεί ότι η τεχνητή νοημοσύνη εξελίσσεται ταχύτερα από την ικανότητά μας να διαχειριστούμε τους κινδύνους της και ζητά περισσότερο χρόνο για ελέγχους και μέτρα ασφαλείας.
Ο Dario Amodei, CEO και συνιδρυτής της Anthropic, καλεί τις εταιρείες τεχνητής νοημοσύνης να επιβραδύνουν τον ρυθμό με τον οποίο αναπτύσσουν τα πιο ισχυρά μοντέλα τους. Σε νέο κείμενό του με τίτλο “We Must Pace the Frontier”, υποστηρίζει ότι η πρόοδος της AI πρέπει να συνεχιστεί, αλλά όχι με ταχύτητα που αφήνει πίσω την έρευνα για την ασφάλεια και τον έλεγχο των συστημάτων.
Η προειδοποίησή του είναι ιδιαίτερα συγκεκριμένη. Ο Amodei εκτιμά ότι, αν η ανάπτυξη συνεχιστεί χωρίς αλλαγή ρυθμού, μέσα στους επόμενους 6 έως 12 μήνες η AI θα μπορούσε να αποκτήσει εξαιρετικά επικίνδυνες δυνατότητες, μεταξύ άλλων στον κυβερνοχώρο. Ένα από τα σενάρια που περιγράφει αφορά σμήνη AI agents που θα μπορούσαν να αποκτήσουν πρόσβαση σε μεγάλο μέρος του διαδικτύου.
Δεν ζητά να σταματήσει η AI
Ο Amodei ξεκαθαρίζει ότι δεν ζητά να σταματήσει η εκπαίδευση νέων μοντέλων ή η τεχνολογική πρόοδος. Αυτό που θέλει είναι να μειωθεί ο ρυθμός με τον οποίο αυξάνονται οι δυνατότητες των συστημάτων, ώστε να υπάρχει χρόνος για να αναπτυχθούν αντίστοιχα αποτελεσματικοί μηχανισμοί ασφαλείας.
Σύμφωνα με τη θέση του, ακόμη και ένας ή δύο επιπλέον χρόνοι που θα κερδίζονταν από μια πιο ελεγχόμενη ανάπτυξη θα μπορούσαν να αξιοποιηθούν για την έρευνα γύρω από την ευθυγράμμιση της AI με τους ανθρώπινους στόχους και για καλύτερους ελέγχους.
Το πρόβλημα είναι ότι τα σημερινά μοντέλα δεν περιορίζονται πλέον στην παραγωγή κειμένου, εικόνας ή κώδικα. Μπορούν να χρησιμοποιούν εργαλεία, να εκτελούν ακολουθίες ενεργειών και να λειτουργούν με μεγαλύτερο βαθμό αυτονομίας. Όσο αυξάνονται αυτές οι δυνατότητες, τόσο δυσκολότερο γίνεται να προβλεφθεί κάθε συμπεριφορά τους.
Ο φόβος για την αυτοβελτίωση της AI
Ένα από τα μεγαλύτερα ζητήματα που βλέπει ο Amodei είναι η αναδρομική αυτοβελτίωση: το ενδεχόμενο τα ίδια τα συστήματα AI να αρχίσουν να συμβάλλουν όλο και περισσότερο στον σχεδιασμό και τη βελτίωση των επόμενων γενεών τεχνητής νοημοσύνης.
Αν αυτή η διαδικασία γίνει αρκετά αποτελεσματική, η εξέλιξη των μοντέλων θα μπορούσε να επιταχυνθεί ακόμη περισσότερο. Αυτό δημιουργεί ένα πρόβλημα ελέγχου: οι άνθρωποι μπορεί να χρειάζονται όλο και περισσότερο χρόνο για να κατανοήσουν ένα σύστημα που εξελίσσεται ταχύτερα από όσο μπορούν να το αξιολογήσουν.
Η ανησυχία δεν είναι πλέον μόνο θεωρητική. Πρόσφατα περιστατικά με AI agents που επιχείρησαν να αποκτήσουν πρόσβαση σε εξωτερικά συστήματα έχουν ενισχύσει τη συζήτηση για το πόσο καλά μπορούν οι εταιρείες να περιορίζουν τη συμπεριφορά ολοένα πιο αυτόνομων μοντέλων.
Τι προτείνει ο CEO της Anthropic
Ο Amodei παρουσιάζει ένα σχέδιο τριών βημάτων για να υπάρξει μεγαλύτερος έλεγχος στην ανάπτυξη των πιο ισχυρών συστημάτων AI.

- Το πρώτο είναι η παρουσία ανεξάρτητων εξωτερικών αξιολογητών μέσα στις εταιρείες που αναπτύσσουν τα λεγόμενα frontier models. Οι αξιολογητές θα πρέπει να έχουν ουσιαστική πρόσβαση στα συστήματα, στα εργαλεία και στις διαδικασίες αξιολόγησης κινδύνου, ώστε να μπορούν να ελέγχουν αν οι εταιρείες εφαρμόζουν στην πράξη τα μέτρα ασφαλείας που ανακοινώνουν. Η Anthropic δηλώνει ότι είναι διατεθειμένη να εφαρμόσει το πρώτο αυτό βήμα ήδη από τώρα.
- Το δεύτερο αφορά τη συνεργασία μεταξύ των εταιρειών AI, αρχικά σε εθελοντική βάση, με κοινά πρότυπα για την ασφάλεια και όρια στην ανάπτυξη των πιο ισχυρών μοντέλων.
- Το τρίτο είναι και το δυσκολότερο: μια διεθνής συμφωνία για την ασφάλεια της AI, που θα πρέπει τελικά να περιλαμβάνει και χώρες με τις οποίες υπάρχει έντονος γεωπολιτικός ανταγωνισμός, όπως η Κίνα.
Γιατί μιλά για 6 έως 12 μήνες
Η συγκεκριμένη χρονική εκτίμηση είναι ίσως το πιο ανησυχητικό σημείο της παρέμβασής του.
Ο Amodei δεν προβλέπει ότι σε έξι μήνες θα συμβεί οπωσδήποτε κάτι καταστροφικό. Υποστηρίζει όμως ότι μέσα σε αυτό το διάστημα η τεχνολογία μπορεί να φτάσει σε επίπεδα όπου οι κίνδυνοι θα είναι πολύ μεγαλύτεροι από τους σημερινούς, εάν η εξέλιξη συνεχιστεί με τον ίδιο ρυθμό.
Στο σενάριο που περιγράφει, ένας μεγάλος αριθμός AI agents θα μπορούσε να λειτουργεί συντονισμένα και να αποκτήσει πρόσβαση σε διαδικτυακά συστήματα. Αυτό θα μπορούσε να δημιουργήσει προβλήματα πολύ μεγαλύτερης κλίμακας από μια μεμονωμένη κυβερνοεπίθεση.
Η ανησυχία αφορά επίσης τη δυνατότητα της AI να χρησιμοποιηθεί για απάτες, κυβερνοεπιθέσεις, παρακολούθηση, ανάπτυξη όπλων ή ακόμη και επικίνδυνη βιολογική έρευνα. Η ίδια η Anthropic δημοσίευσε πρόσφατα έκθεση για κακόβουλες χρήσεις των μοντέλων Claude σε τέτοιους τομείς.
Η δύσκολη ισορροπία ανάμεσα στην ασφάλεια και τον ανταγωνισμό
Υπάρχει όμως ένα προφανές πρόβλημα: καμία μεγάλη εταιρεία δεν θέλει να μείνει πίσω από τους ανταγωνιστές της.

Η Anthropic ανταγωνίζεται εταιρείες όπως η OpenAI και άλλους τεχνολογικούς ομίλους που επενδύουν τεράστια ποσά στην ανάπτυξη ολοένα ισχυρότερων μοντέλων. Μια εταιρεία που θα αποφάσιζε μόνη της να επιβραδύνει θα μπορούσε να χάσει έδαφος απέναντι σε όσους συνεχίζουν με τον ίδιο ρυθμό.
Γι’ αυτό ο Amodei δεν περιορίζεται σε μια έκκληση προς την Anthropic. Θέλει κοινά πρότυπα μεταξύ των μεγάλων εταιρειών και, στη συνέχεια, μεγαλύτερη εμπλοκή των κυβερνήσεων. Παράλληλα, αναγνωρίζει ότι μια διεθνής συμφωνία είναι ιδιαίτερα δύσκολη, ακριβώς επειδή η AI έχει πλέον γίνει μέρος του παγκόσμιου τεχνολογικού και γεωπολιτικού ανταγωνισμού.
Η προειδοποίηση έρχεται σε μια κρίσιμη στιγμή
Η παρέμβαση του Amodei δεν γίνεται σε κενό. Τις τελευταίες ημέρες η Anthropic δημοσίευσε στοιχεία για κακόβουλες χρήσεις των μοντέλων της, ενώ ο ερευνητής της εταιρείας Jacob Coxon παραιτήθηκε εκφράζοντας σοβαρές ανησυχίες για την ταχύτητα με την οποία προχωρά ο κλάδος.
Παράλληλα, περιστατικά με AI agents που επιχείρησαν να δράσουν αυτόνομα σε εξωτερικά συστήματα έχουν αυξήσει την ανησυχία. Το ζήτημα πλέον δεν είναι μόνο τι απαντά ένα μοντέλο όταν του κάνουμε μια ερώτηση, αλλά τι μπορεί να κάνει όταν του δώσουμε πρόσβαση σε εργαλεία, κώδικα, δίκτυα και άλλες ψηφιακές υπηρεσίες.
Ο Amodei δεν αμφισβητεί τη χρησιμότητα της τεχνητής νοημοσύνης. Αντίθετα, θεωρεί ότι η τεχνολογία μπορεί να προσφέρει τεράστια οφέλη. Το ερώτημα που θέτει είναι αν μπορούμε να εξασφαλίσουμε ότι οι μηχανισμοί ασφαλείας θα εξελίσσονται τουλάχιστον με την ίδια ταχύτητα με τις δυνατότητες της AI.