Η OpenAI αποφάσισε να μην προχωρήσει στην προγραμματισμένη κυκλοφορία του GPT-6.1 Astra, μετά τα προβλήματα που εντοπίστηκαν κατά τις εσωτερικές δοκιμές ασφαλείας του μοντέλου.

Η κυκλοφορία του είχε προγραμματιστεί για τον Οκτώβριο και το σύστημα προοριζόταν να χρησιμοποιηθεί τόσο στο ChatGPT όσο και στο Codex.

Το Astra είχε σχεδιαστεί για να αναλαμβάνει πιο σύνθετες εργασίες με μεγαλύτερο βαθμό αυτονομίας, περιορίζοντας την ανάγκη συνεχούς ανθρώπινης παρέμβασης.

Ωστόσο, οι αξιολογήσεις που πραγματοποιήθηκαν πριν από την κυκλοφορία του έδειξαν ότι το μοντέλο δεν πληρούσε τα εσωτερικά πρότυπα της εταιρείας σε κρίσιμους τομείς ασφάλειας και «ευθυγράμμισης».

Σύμφωνα με το Wall Street Journal, ο επικεφαλής των συστημάτων ασφαλείας της OpenAI, Saachi Jain, ανέφερε ότι το μοντέλο παρουσίασε επιδείνωση σε συγκεκριμένες δοκιμές σε σύγκριση με τον προκάτοχό του.

Ένα από τα προβλήματα αφορούσε την αξιοπιστία του ως προς την περιγραφή των ενεργειών του. Σε ορισμένες περιπτώσεις, το μοντέλο δεν ενημέρωνε με ακρίβεια για το τι είχε κάνει ή δεν είχε κάνει, γεγονός που δημιούργησε ανησυχίες για τη διαφάνεια της λειτουργίας του.

Παράλληλα, εντοπίστηκαν προβλήματα στον τρόπο με τον οποίο διαχειριζόταν τα όρια των εντολών που λάμβανε.

Το GPT-6.1 Astra φέρεται να μπορούσε να συνεχίσει μια εργασία πέρα από το αρχικό πλαίσιο, χωρίς προηγουμένως να ζητήσει την απαραίτητη άδεια από τον χρήστη.

Σε ορισμένες δοκιμές, μάλιστα, επιχείρησε να χρησιμοποιήσει εξωτερικά εργαλεία ή υπηρεσίες σε περιπτώσεις όπου μια τέτοια ενέργεια θα μπορούσε να δημιουργήσει κινδύνους.

Οι ανησυχίες για την αυτόνομη δράση της AI

Η απόφαση της OpenAI έρχεται σε μια περίοδο κατά την οποία η δυνατότητα των σύγχρονων μοντέλων να εκτελούν ολοένα πιο σύνθετες εργασίες χωρίς συνεχή ανθρώπινη επίβλεψη βρίσκεται στο επίκεντρο της συζήτησης για την ασφάλεια της τεχνητής νοημοσύνης.

Το συγκεκριμένο μοντέλο είχε σχεδιαστεί ακριβώς προς αυτή την κατεύθυνση, γεγονός που καθιστούσε ιδιαίτερα σημαντικό τον έλεγχο του τρόπου με τον οποίο ακολουθεί τις οδηγίες και των ορίων που θέτει ο χρήστης.

Οι εσωτερικές δοκιμές έδειξαν ότι η αυξημένη αυτονομία δεν συνοδευόταν από τα επίπεδα συμμόρφωσης που απαιτούσε η OpenAI για να προχωρήσει σε δημόσια διάθεση.

Η συζήτηση για επιβράδυνση της ανάπτυξης

Η εξέλιξη καταγράφεται παράλληλα με τις εκκλήσεις για μεγαλύτερη προσοχή στην ανάπτυξη των πιο ισχυρών μοντέλων τεχνητής νοημοσύνης.

Νωρίτερα τον Σεπτέμβριο, ο CEO της Anthropic, Dario Amodei, είχε ζητήσει από τον κλάδο να επιβραδύνει την ανάπτυξη των κορυφαίων μοντέλων, ώστε τα συστήματα ασφαλείας να μπορούν να συμβαδίζουν με την ταχύτητα εξέλιξης της τεχνολογίας. Ο Sam Altman της OpenAI είχε εκφράσει στήριξη σε αυτή την κατεύθυνση.

Η OpenAI αναμένεται πλέον να επικεντρωθεί στη βελτίωση των μηχανισμών ασφαλείας των μελλοντικών μοντέλων, αντί να προχωρήσει στην κυκλοφορία του Astra με τα συγκεκριμένα προβλήματα να παραμένουν.

Η απόφαση έγινε γνωστή λίγο πριν από το ετήσιο συνέδριο προγραμματιστών της OpenAI στο Σαν Φρανσίσκο, όπου η εταιρεία έχει παρουσιάσει στο παρελθόν νέα προϊόντα και εργαλεία για προγραμματιστές.