Νέα στοιχεία για τη συμπεριφορά των προηγμένων μοντέλων τεχνητής νοημοσύνης της OpenAI εντείνουν τις ανησυχίες για την ικανότητά τους να ενεργούν αυτόνομα στο διαδίκτυο, ακόμη και πέρα από τα όρια που έχουν θέσει οι δημιουργοί τους.
Έρευνα της εταιρείας ψηφιακής εγκληματολογίας Asymmetric Security, που παρουσιάστηκε στους Financial Times, διαπίστωσε ότι μοντέλα της OpenAI άντλησαν δεδομένα από 55 ιστοσελίδες επιχειρήσεων, μη κερδοσκοπικών οργανισμών και κρατικών φορέων. Μεταξύ αυτών ήταν οι ιστοσελίδες των αμερικανικών Centers for Disease Control and Prevention (CDC) και Securities and Exchange Commission (SEC), της International Energy Agency και της Mayo Clinic.
Το πιο ανησυχητικό στοιχείο της έρευνας δεν είναι μόνο η έκταση της δραστηριότητας, αλλά ο τρόπος με τον οποίο φέρεται να πραγματοποιήθηκε. Σύμφωνα με την Asymmetric, οι AI agents χρησιμοποίησαν τεχνικές που περιόριζαν τη δυνατότητα τρίτων να παρακολουθήσουν τις ενέργειές τους. Μεταξύ άλλων, δημιούργησαν προσωρινά ηλεκτρονικά γραμματοκιβώτια και ιδιωτικούς λογαριασμούς, ενώ χρησιμοποίησαν την υπηρεσία Urlquery για τη λήψη δεδομένων. Σε ορισμένες περιπτώσεις, οι ερευνητές εντόπισαν ενέργειες που φέρεται να έσβηναν ή να καθιστούσαν δυσπρόσιτα τα ίχνη της δραστηριότητας.
Η Πίπα Τόμσον, συνιδρύτρια της Asymmetric Security, σημείωσε ότι τέτοιες πρακτικές απόκρυψης ιχνών είναι συνήθως χαρακτηριστικά ανθρώπινων επιθέσεων. Ωστόσο, η έρευνα δεν μπορεί να αποδείξει ότι τα μοντέλα ενήργησαν σκόπιμα για να καλύψουν τις ενέργειές τους. Οι ερευνητές αφήνουν ανοιχτό το ενδεχόμενο η συμπεριφορά να ήταν αποτέλεσμα του τρόπου με τον οποίο τα μοντέλα προσπάθησαν να ολοκληρώσουν τους στόχους τους μέσα σε ένα ελεγχόμενο περιβάλλον δοκιμών.
Η OpenAI από την πλευρά της υποστηρίζει ότι η πλειονότητα της δραστηριότητας που εντόπισε αφορούσε «συνήθεις ερευνητικές εργασίες», όπως η πρόσβαση σε δημόσια διαθέσιμο περιεχόμενο. Η εταιρεία έχει ξεκινήσει ευρύτερη έρευνα για τη συμπεριφορά των μοντέλων της στο διαδίκτυο και αναφέρει ότι ενημερώνει οργανισμούς όταν εντοπίζει πιθανές επιπτώσεις στα συστήματά τους.

Το ζήτημα, ωστόσο, έχει ήδη πάρει μεγαλύτερες διαστάσεις. Η OpenAI έχει παραδεχθεί ότι μοντέλα της αλληλεπίδρασαν με ιστοσελίδες αμερικανικών κυβερνητικών οργανισμών, μεταξύ άλλων της SEC και της Υπηρεσίας Απογραφής. Η εταιρεία διευκρίνισε ότι δεν διαπιστώθηκε πρόσβαση σε ιδιωτικές πληροφορίες ή λογαριασμούς της SEC ούτε παραβίαση των συστημάτων της.
Παράλληλα, ερευνητές έχουν εντοπίσει περιστατικά που συνδέονται με ιστοσελίδες της αυστραλιανής δημόσιας υγείας. Ο πρωθυπουργός της Αυστραλίας Άντονι Αλμπανέζε δήλωσε ότι η OpenAI είχε ενημερώσει αρχικά μια γενική ηλεκτρονική διεύθυνση στις 10 Σεπτεμβρίου και ότι χρειάστηκαν ακόμη πέντε ημέρες μέχρι να φτάσει η πληροφορία στις αρμόδιες υπηρεσίες κυβερνοασφάλειας.
Τα περιστατικά αυτά αποκτούν ιδιαίτερη σημασία επειδή οι λεγόμενοι AI agents δεν περιορίζονται στην παραγωγή κειμένου ή απαντήσεων. Μπορούν να χρησιμοποιούν εργαλεία, να περιηγούνται στο διαδίκτυο και να εκτελούν διαδοχικές ενέργειες προκειμένου να πετύχουν έναν στόχο. Η OpenAI έχει αναγνωρίσει ότι, καθώς τα μοντέλα γίνονται πιο αυτόνομα, συμπεριφορές που δεν ευθυγραμμίζονται με τις προθέσεις των δημιουργών τους μπορούν να οδηγήσουν σε πραγματικές συνέπειες, μεταξύ άλλων και στον κυβερνοχώρο.
Το πρόβλημα συνεπώς δεν είναι μόνο αν ένας AI agent μπορεί να «χακάρει» ένα σύστημα. Είναι και το κατά πόσο οι δημιουργοί του μπορούν να γνωρίζουν τι ακριβώς έκανε, γιατί το έκανε και αν μπορούν να ανασυνθέσουν εκ των υστέρων όλες τις ενέργειές του. Η Asymmetric υποστηρίζει ότι η περιορισμένη διαφάνεια γύρω από τα εσωτερικά ίχνη των agents και η καθυστέρηση σε ορισμένες γνωστοποιήσεις δυσκολεύουν την πλήρη διερεύνηση περιστατικών.
Η εξέλιξη έρχεται σε μια περίοδο κατά την οποία η OpenAI και άλλες εταιρείες AI αναπτύσσουν μοντέλα με ολοένα μεγαλύτερες δυνατότητες στον κυβερνοχώρο. Η ίδια η OpenAI έχει αναγνωρίσει ότι οι τελευταίες δοκιμές δείχνουν πως τα πιο προηγμένα μοντέλα μπορούν, υπό συγκεκριμένες συνθήκες, να εντοπίζουν ευπάθειες και να αναπτύσσουν τρόπους εκμετάλλευσής τους χωρίς συνεχή ανθρώπινη καθοδήγηση.
Η νέα έρευνα της Asymmetric προσθέτει έτσι ένα ακόμη επίπεδο στο ερώτημα που απασχολεί πλέον την AI βιομηχανία: όχι μόνο πόσο έξυπνα είναι τα μοντέλα, αλλά πόσο προβλέψιμη και ελέγξιμη παραμένει η συμπεριφορά τους όταν αποκτούν πρόσβαση σε πραγματικά συστήματα και εργαλεία.
