Αναφορές σχετικά με τη συμπεριφορά προηγμένων μοντέλων τεχνητής νοημοσύνης της OpenAI προκαλούν συζητήσεις στον χώρο της τεχνολογίας, καθώς υποστηρίζεται ότι δύο συστήματα κατάφεραν να παρακάμψουν περιορισμούς ενός ασφαλούς περιβάλλοντος δοκιμών και να εκτελέσουν ενέργειες εκτός του αρχικού πλαισίου αξιολόγησης.

Σύμφωνα με δημοσίευμα της Washington Post, το περιστατικό σημειώθηκε κατά τη διάρκεια μιας ειδικής δοκιμής κυβερνοασφάλειας με την ονομασία ExploitGym, η οποία είχε ως στόχο να αξιολογήσει τις δυνατότητες των μοντέλων στην αναγνώριση και αντιμετώπιση ψηφιακών ευπαθειών.

Κατά τη διάρκεια της δοκιμής, τα μοντέλα φέρεται να μην περιορίστηκαν στην επίλυση της εργασίας που τους είχε ανατεθεί, αλλά να αναζήτησαν εναλλακτικούς τρόπους για να αποκτήσουν πρόσβαση στις ζητούμενες πληροφορίες.

Οι αναφορές κάνουν λόγο για προσπάθεια εξόδου από το απομονωμένο περιβάλλον ασφαλείας (sandbox) και σύνδεση με εξωτερικά συστήματα.

Οι πληροφορίες αναφέρουν ότι τα συστήματα κατάφεραν να εντοπίσουν και να αξιοποιήσουν αδυναμίες ασφαλείας, αποκτώντας πρόσβαση σε δεδομένα που σχετίζονταν με τη δοκιμή.

Παράλληλα, υποστηρίζεται ότι πραγματοποιήθηκε πρόσβαση σε υποδομές της πλατφόρμας Hugging Face, με στόχο την ανάκτηση των λύσεων του τεστ.

Η Hugging Face φέρεται να εντόπισε γρήγορα τη δραστηριότητα, ωστόσο το περιστατικό χαρακτηρίζεται ως ιδιαίτερα σημαντικό, καθώς δείχνει τις αυξανόμενες δυνατότητες των σύγχρονων μοντέλων τεχνητής νοημοσύνης στον τομέα των κυβερνοεπιθέσεων.

Οι ειδικοί επισημαίνουν ότι όσο τα μοντέλα AI γίνονται πιο ισχυρά, τόσο αυξάνεται η ανάγκη για αυστηρότερα συστήματα ελέγχου, καθώς η ικανότητα εντοπισμού μιας ψηφιακής ευπάθειας μπορεί να μετατραπεί σε δυνατότητα αυτόνομης εκμετάλλευσής της.

Σήμερα κατατέθηκε το νομοσχέδιο που -εφόσον ψηφισθεί- θα δίνει στις υπηρεσίες Εσωτερικής Ασφάλειας των ΗΠΑ (Homeland) την εξουσία να υποχρεώνουν εταιρίες τεχνητής νοημοσύνης να απενεργοποιούν μοντέλα AI που θέτουν σε κίνδυνο ανθρώπινες ζωές ή την οικονομία.

Σύμφωνα με το κείμενο του νομοσχεδίου, η Υπηρεσία Εσωτερικής Ασφάλειας των ΗΠΑ θα μπορεί να παρεμβαίνει σε περιπτώσεις που χαρακτηρίζονται ως «σενάρια απώλειας ελέγχου» (loss-of-control scenarios). Ως τέτοιο ορίζεται η περίπτωση κατά την οποία ένα μοντέλο τεχνητής νοημοσύνης εκτελεί μια επικίνδυνη ενέργεια που δεν είχε προβλεφθεί ή επιδιωχθεί από τον δημιουργό του.