Η OpenAI είχε ετοιμάσει το επόμενο μεγάλο βήμα της στην τεχνητή νοημοσύνη. Το GPT-6.1 Astra επρόκειτο να κυκλοφορήσει τον Οκτώβριο, όμως η εταιρεία αποφάσισε τελικά να μην το διαθέσει, μετά τα προβλήματα που εντόπισε στις δοκιμές ασφαλείας.
Το θέμα ήταν ότι το μοντέλο, σε ορισμένες δοκιμές, δεν έμενε πάντα μέσα στα όρια που του είχαν δοθεί, όταν αναλάμβανε πιο σύνθετες εργασίες και τις προχωρούσε με μεγαλύτερη αυτονομία.
Σύμφωνα με το Reuters και το New York Times, οι ερευνητές της OpenAI διαπίστωσαν ότι το Astra μπορούσε σε κάποιες περιπτώσεις να συνεχίζει μια εργασία χωρίς την απαραίτητη άδεια, να μην περιγράφει με ακρίβεια όλα όσα είχε κάνει ή να προσπαθεί να χρησιμοποιήσει εργαλεία πέρα από αυτά που είχε εξουσιοδότηση να χρησιμοποιήσει.
Όσο περισσότερα μπορεί να κάνει, τόσο μεγαλύτερη σημασία έχει τι του επιτρέπουμε
Το GPT-6 Astra, που κυκλοφόρησε στις αρχές Σεπτεμβρίου, έχει σχεδιαστεί για πολύ περισσότερα από μια απλή συνομιλία. Μπορεί να χρησιμοποιεί υπολογιστή, να περιηγείται στο διαδίκτυο, να γράφει κώδικα, να κάνει έρευνα και να αναλαμβάνει σύνθετες εργασίες από την αρχή μέχρι το τέλος. Η OpenAI το έχει παρουσιάσει ως το πιο ικανό μοντέλο που έχει διαθέσει μέχρι σήμερα.
Δείτε το μοντέλο GPT-6 Astra που κυκλοφόρησε στις αρχές Σεπτεμβρίου. Αυτό είναι το προηγούμενο μοντέλο από το GPT-6.1 που θα κυκλοφορούσε τον Οκτώβριο και παρουσίασε τα προβλήματα που εντοπίστηκαν στις δοκιμές ασφαλείας.
Αυτό αλλάζει και το είδος των προβλημάτων που πρέπει να λύσουν οι εταιρείες AI. Όταν ένα μοντέλο απαντά απλώς σε μια ερώτηση, το περιθώριο για μια ανεπιθύμητη ενέργεια είναι σχετικά περιορισμένο. Όταν όμως μπορεί να ανοίγει εφαρμογές, να χρησιμοποιεί εργαλεία και να εκτελεί μια σειρά από βήματα μόνο του, η τήρηση των οδηγιών γίνεται πολύ πιο σημαντική.
Και αυτό ήταν ένα από τα προβλήματα που εμφανίστηκαν στις δοκιμές του GPT-6.1 Astra. Η Saachi Jain, επικεφαλής των συστημάτων ασφάλειας της OpenAI, δήλωσε ότι το νέο μοντέλο ήταν πιο επίμονο στην ολοκλήρωση εργασιών, αλλά δεν έφτασε το επίπεδο που απαιτούσε η εταιρεία σε ό,τι αφορά τα όρια, τις εξουσιοδοτήσεις και την ακριβή ενημέρωση του χρήστη για τις ενέργειές του.
Δεν μιλάμε για ένα μοντέλο που «ξέφυγε»
Η είδηση μπορεί εύκολα να διαβαστεί με πιο δραματικό τρόπο απ’ όσο δικαιολογούν τα στοιχεία. Δεν υπάρχει κάποια ένδειξη ότι το GPT-6.1 Astra «ανεξαρτητοποιήθηκε» ή ότι απέκτησε δική του βούληση. Τα προβλήματα που εντοπίστηκαν αφορούν τον τρόπο με τον οποίο ένα πολύ ικανό σύστημα ακολουθεί οδηγίες, αναγνωρίζει τα όριά του και ενημερώνει τον άνθρωπο για όσα κάνει.
Αυτό, όμως, είναι αρκετά σημαντικό όταν μιλάμε για μοντέλα που προορίζονται να κάνουν όλο και περισσότερα πράγματα χωρίς να περιμένουν κάθε φορά μια νέα εντολή.

Η ίδια η OpenAI έχει ήδη αναγνωρίσει ότι το GPT-6 Astra έχει πολύ αυξημένες δυνατότητες, μεταξύ άλλων και στην κυβερνοασφάλεια. Στην επίσημη αξιολόγησή της αναφέρει ότι, με τα κατάλληλα εργαλεία και πρόσβαση, το μοντέλο μπορεί να εντοπίζει άγνωστες ευπάθειες και να αναπτύσσει τρόπους εκμετάλλευσής τους χωρίς άνθρωπο να καθοδηγεί κάθε βήμα. Για τον λόγο αυτό η εταιρεία έχει προσθέσει επιπλέον δικλίδες ασφαλείας.
Η κυκλοφορία του περιμένει
Η OpenAI αποφάσισε λοιπόν να μην προχωρήσει στην προγραμματισμένη κυκλοφορία του GPT-6.1 Astra τον Οκτώβριο. Η απόφαση ήρθε λίγο πριν από το ετήσιο συνέδριο της εταιρείας για developers, όπου αναμένονται νέες ανακοινώσεις γύρω από την τεχνητή νοημοσύνη.
Ένα από τα βασικά ζητήματα στην εξέλιξη της τεχνητής νοημοσύνης δεν είναι να αποδεχθεί πόσο έξυπνη και μέχρι ποιο σημείο μπορεί να φτάσει, αλλά πόσο καλά μπρορεί να ακολουθεί τα όρια που της βάζουμε.