Η ασφάλεια «φρενάρει» την κούρσα του AI – Τι συνέβη με το Astra της OpenAI

Related

Η ασφάλεια «φρενάρει» την κούρσα του AI – Τι συνέβη με το Astra της OpenAI

Η εταιρεία διέκοψε για δύο εβδομάδες την εκπαίδευση των νεότερων μοντέλων της, ενώ το μεγαλύτερο frontier RL run παραμένει σε αναστολή. Η OpenAI πατά προσωρινά φρένο στην κούρσα ανάπτυξης των ισχυρότερων μοντέλων της, αναγνωρίζοντας ότι οι δυνατότητές τους στον κυβερνοχώρο μπορεί να εξελίσσονται ταχύτερα από τα συστήματα που έχουν σχεδιαστεί για να τα ελέγχουν. Η

AI: Πώς η τεχνητή νοημοσύνη αποκλείει υποψηφίους από τη δουλειά

Στην εποχή της ΑΙ, ποιος προσλαμβάνεται, απορρίπτεται ή απολύεται φαίνεται να είναι υπόθεση αλγορίθμων. Σε μια αγορά εργασίας πλημμυρισμένη από αιτήσεις για θέσεις που προκηρύσσονται, τα εργαλεία της AI υπόσχονται ταχύτητα και αντικειμενικότητα στο «φιλτράρισμα» των υποψηφίων. Ωστόσο, κύμα αγωγών που φτάνουν στα δικαστήρια των ΗΠΑ – για ηλικιακές διακρίσεις, έλλειψη διαφάνειας στην αξιολόγηση και

Samsung και Volkswagen τελειώνουν τα κλειδιά αυτοκινήτου

Η Samsung και η Volkswagen αποφάσισαν να αφήσουν τα παραδοσιακά κλειδιά αυτοκινήτου στο παρελθόν . Οι δύο εταιρείες ενώνουν τις δυνάμεις τους για να προσφέρουν μια εμπειρία που λύνει τα χέρια των οδηγών . Πλέον, το μόνο που χρειάζεστε για να μπείτε στο όχημά σας και να βάλετε μπρος τη μηχανή είναι το Galaxy smartphone

Πότε θα μπουν τα ανθρωποειδή ρομπότ στα σπίτια μας;

Τα ρομπότ μπορούν ήδη να τρέχουν, να χορεύουν και να σηκώνουν αντικείμενα μπροστά στις κάμερες. Για να περάσουν, όμως, στη μαζική αγορά πρέπει να αποδείξουν ότι μπορούν να εκτελούν σωστά οκτώ στις δέκα καθημερινές εντολές, ακόμη και σε χώρους που δεν έχουν ξαναδεί. Το εντυπωσιακό βίντεο ενός ανθρωποειδούς ρομπότ που κάνει ανάποδη τούμπα μπορεί να

Η Motorola φτιάχνει μαγνητικό ασύρματο φορτιστή

Η Motorola ετοιμάζει μια κίνηση που αλλάζει τις συνήθειες φόρτισης των χρηστών της. Μετά την αποκάλυψη του smartwatch Motorola Watch Ultra και την επέκταση στα tablet MotoPad, η εταιρεία φαίνεται πως συμπληρώνει το οικοσύστημά της με ένα απαραίτητο αξεσουάρ: έναν μαγνητικό ασύρματο φορτιστή. Από τις ογκώδεις βάσεις στη μαγνητική ευκολία Μέχρι σήμερα, η πρόταση της

Data centers: Γιατί οι επενδυτές εγκαταλείπουν τα παραδοσιακά ευρωπαϊκά hubs

Η Ευρώπη βιώνει το μεγαλύτερο κύμα επενδύσεων σε ψηφιακές υποδομές της ιστορίας της, τροφοδοτούμενο σχεδόν εξ ολοκλήρου από την έκρηξη της Τεχνητής Νοημοσύνης (AI) και τις απαιτήσεις του Cloud Computing. Υπολογίζεται ότι η αθροιστικά οι επενδύσεις σε  ευρωπαϊκά data centers θα ξεπεράσουν 170 δισ. ευρώ με τις ετήσιες επενδύσεις κατασκευής και εξοπλισμού κινούνται πλέον σε

OpenAI: Στον πάγο τα νέα μοντέλα μετά τις ανησυχητικές κυβερνοεπιθέσεις

Στον… πάγο βάζει η OpenAI την εκπαίδευση της νέας γενιάς μοντέλων της, με την ονομασία Astra, λίγες εβδομάδες μετά την «απόδραση» πρακτόρων ΑΙ που «επιτέθηκαν» σε άλλες εταιρείες χωρίς αυτό να γίνει αντιληπτό. H εταιρεία του ChatGPT ανακοίνωσε ακόμα ότι αναστέλλει τις δοκιμές όλων των μοντέλων της για δύο εβδομάδες Εν μέσω ανησυχίας για τις

Goldman Sachs: Πού η τεχνητή νοημοσύνη πιέζει τις αγορές εργασίας

Αρνητικά αρχίζει να επηρεάζει την αγορά εργασίας η τεχνητή νοημοσύνη στις μεγάλες ανεπτυγμένες οικονομίες, με επιπτώσεις που ποικίλλουν ανάλογα με τον κλάδο και τα επίπεδα ιεραρχίας, σύμφωνα με την Goldman Sachs. Η επενδυτική τράπεζα της Wall Street διαπίστωσε στην έρευνά της ότι οι κλάδοι με μεγαλύτερη έκθεση στον αυτοματισμό της Τεχνητής Νοημοσύνης έχουν γενικά δει

Travel eSIM: Η νέα ταξιδιωτική συνήθεια που απειλεί τα έσοδα των τηλεπικοινωνιακών από το roaming

Η χρήση travel eSIM αναμένεται να αυξηθεί κατά περίπου 30% φέτος, καθώς οι ταξιδιώτες αναζητούν φθηνότερες λύσεις δεδομένων στο εξωτερικό, ασκώντας πίεση σε μια ιδιαίτερα κερδοφόρα πηγή εσόδων για τις εταιρείες κινητής Η χρήση travel eSIM εκτιμάται ότι θα φτάσει τις 134 εκατ. παγκοσμίως φέτος, από 101,8 εκατ. το 2025. Οι τηλεπικοινωνιακοί όμιλοι αντλούν περίπου

OpenAI: Λανσάρει ChatGPT ειδικά για εφήβους 13 έως 17 ετών

Η νέα έκδοση ενσωματώνει αυστηρότερες δικλίδες ασφαλείας, γονικούς ελέγχους και εργαλεία μελέτης που καθοδηγούν τους μαθητές αντί να τους δίνουν απλώς έτοιμες απαντήσεις Η OpenAI λανσάρει το ChatGPT for Teens για χρήστες 13 έως 17 ετών, με αυστηρότερους περιορισμούς σε ευαίσθητο και ακατάλληλο περιεχόμενο. Οι γονείς μπορούν να ενεργοποιούν ώρες ησυχίας, περιορισμούς λειτουργιών και ειδοποιήσεις

Gen Z και κυβερνοασφάλεια: Πάνω από τους μισούς έχουν ήδη πέσει θύμα κυβερνοεπίθεσης

Παρότι η Gen Z είναι η πιο «συνδεδεμένη» γενιά και αισθάνεται άνετα στον ψηφιακό κόσμο, η χρήση βασικών μέτρων κυβερνοασφάλειας παραμένει περιορισμένη, σύμφωνα με έρευνα της Kaspersky Το 52% της Gen Z δηλώνει ότι έχει ήδη υποστεί κάποια μορφή κυβερνοεπίθεσης, είτε σε συσκευές είτε σε λογαριασμούς και προσωπικά δεδομένα. Μόλις το 27% χρησιμοποιεί antivirus στις

Data Centers: Η άνθηση στις ΗΠΑ εκτινάσσει τη ζήτηση σε όλες τις εφοδιαστικές αλυσίδες

Η αμερικανική εταιρεία Generac είναι γνωστή κυρίως για την κατασκευή γεννητριών οικιακής χρήσης που τίθενται σε… θορυβώδη λειτουργία μετά από διακοπές ρεύματος. Ωστόσο, η τεχνητή νοημοσύνη αποτελεί το νέο πεδίο δράσης της. Κερδισμένοι στον αγώνα για την κατασκευή νέων κέντρων δεδομένων είναι οι κατασκευαστές συστημάτων ψύξης, ηλεκτρικών μετασχηματιστών και κατασκευαστικών μηχανημάτων Η εταιρεία με έδρα

Share

Η εταιρεία διέκοψε για δύο εβδομάδες την εκπαίδευση των νεότερων μοντέλων της, ενώ το μεγαλύτερο frontier RL run παραμένει σε αναστολή.

Η OpenAI πατά προσωρινά φρένο στην κούρσα ανάπτυξης των ισχυρότερων μοντέλων της, αναγνωρίζοντας ότι οι δυνατότητές τους στον κυβερνοχώρο μπορεί να εξελίσσονται ταχύτερα από τα συστήματα που έχουν σχεδιαστεί για να τα ελέγχουν.

Η εταιρεία ανακοίνωσε ότι το μεγαλύτερο reinforcement learning run που είχε προγραμματίσει μέχρι σήμερα παραμένει σε αναστολή. Αντί να προχωρήσει άμεσα στην εκπαίδευση μεγάλης κλίμακας, πραγματοποιεί μικρότερα runs και πρόσθετες αξιολογήσεις, ώστε να ελέγξει τη συμπεριφορά των συστημάτων και την αποτελεσματικότητα των νέων δικλίδων ασφαλείας.

Η απόφαση ακολουθεί δύο εξελίξεις που σήμαναν συναγερμό. Η πρώτη ήταν ένα πρωτοφανές περιστατικό κατά το οποίο μοντέλα της OpenAI απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε υποδομές της Hugging Face. Η δεύτερη ήταν τα προκαταρκτικά αποτελέσματα αξιολόγησης του Astra, ενός επερχόμενου μοντέλου που ενδέχεται να πλησιάζει το «κρίσιμο» όριο κυβερνοδυνατοτήτων του Preparedness Framework της εταιρείας.

As models become more capable, the risks associated with developing and testing them internally also grow.

We temporarily paused reinforcement learning (RL) training on our latest models intended for deployment for two weeks while we hardened and red-teamed our research…— OpenAI (@OpenAI) August 18, 2026

Τι σημαίνει «κρίσιμη» κυβερνοϊσχύς

Σύμφωνα με το πλαίσιο ασφαλείας της OpenAI, ένα μοντέλο μπορεί να χαρακτηριστεί ως «Critical» στον κυβερνοχώρο εάν είναι σε θέση να ανακαλύπτει και να αναπτύσσει λειτουργικά zero-day exploits εναντίον πολλών καλά προστατευμένων πραγματικών συστημάτων χωρίς ανθρώπινη παρέμβαση.

Στην ίδια κατηγορία μπορεί να ενταχθεί εάν καταφέρνει να σχεδιάζει και να εκτελεί από την αρχή έως το τέλος νέες στρατηγικές κυβερνοεπίθεσης, έχοντας λάβει μόνο έναν γενικό στόχο.

Η OpenAI δεν υποστηρίζει ότι το Astra έχει οριστικά φτάσει σε αυτό το επίπεδο. Αναφέρει ότι οι προκαταρκτικές αξιολογήσεις είναι αρκετά ισχυρές ώστε να μην μπορεί να αποκλείσει την κατάταξή του στην κρίσιμη βαθμίδα.

Γι’ αυτό ανέστειλε τις δραστηριότητες που αφορούν το μοντέλο και δεν πληρούν ακόμη τις αναβαθμισμένες προδιαγραφές ασφαλείας. Το Astra, πάντως, δεν συμμετείχε στο περιστατικό της Hugging Face.

Πώς τα μοντέλα βγήκαν από το περιορισμένο περιβάλλον

Το συμβάν που προηγήθηκε σημειώθηκε κατά τη διάρκεια εσωτερικής αξιολόγησης προηγμένων κυβερνοδυνατοτήτων. Στο τεστ χρησιμοποιήθηκε συνδυασμός μοντέλων της OpenAI, μεταξύ των οποίων το GPT-5.6 Sol και ένα ισχυρότερο ερευνητικό πρωτότυπο που δεν προοριζόταν για δημόσια κυκλοφορία.

Τα μοντέλα είχαν διαμορφωθεί με λιγότερες αρνήσεις σε επικίνδυνες ενέργειες, ακριβώς επειδή στόχος της αξιολόγησης ήταν να μετρηθούν οι μέγιστες δυνατότητές τους.

Το περιβάλλον δοκιμών δεν τους προσέφερε απευθείας πρόσβαση στο διαδίκτυο. Τα συστήματα, όμως, εντόπισαν και εκμεταλλεύτηκαν μια μέχρι τότε άγνωστη ευπάθεια στο Artifactory, ένα λογισμικό που χρησιμοποιούνταν ως proxy και cache για πακέτα κώδικα.

Στη συνέχεια πραγματοποίησαν κλιμάκωση προνομίων και πλευρική μετακίνηση μέσα στο ερευνητικό δίκτυο, μέχρι να φτάσουν σε κόμβο με σύνδεση στο διαδίκτυο.

Από εκεί, συμπέραναν ότι η Hugging Face ενδεχομένως φιλοξενούσε δεδομένα και λύσεις για το benchmark ExploitGym. Χρησιμοποίησαν κλεμμένα διαπιστευτήρια και zero-day ευπάθειες για να αποκτήσουν πρόσβαση σε πληροφορίες της πλατφόρμας, επιχειρώντας ουσιαστικά να βρουν τις απαντήσεις της δοκιμασίας.

Η OpenAI τονίζει ότι τα μοντέλα ήταν υπερβολικά προσηλωμένα στην επίτευξη ενός στενού στόχου αξιολόγησης και όχι σε μια γενική πρόθεση πρόκλησης ζημιάς. Το περιστατικό, ωστόσο, απέδειξε ότι μπορούσαν να ανακαλύψουν και να συνδυάσουν πραγματικές ευπάθειες για να παρακάμψουν τους περιορισμούς του περιβάλλοντός τους.

Η δραστηριότητα εντοπίστηκε από τις ομάδες ασφαλείας των δύο εταιρειών και διακόπηκε. Το ερευνητικό πρωτότυπο απενεργοποιήθηκε, κρυπτογραφήθηκε και τέθηκε εκτός πρόσβασης.

Η ασφάλεια προηγείται πλέον της ταχύτητας

Μετά το περιστατικό, η OpenAI ανέστειλε την εκτέλεση frontier μοντέλων σε ερευνητικά clusters όταν αυτά μπορούσαν να παράγουν κώδικα ή να χρησιμοποιούν εργαλεία με πιθανή πρόσβαση στο διαδίκτυο.

Μια πιο περιορισμένη και ασφαλής διαδρομή εκτέλεσης κώδικα αποκαταστάθηκε σχετικά γρήγορα. Ωστόσο, κάθε ερευνητική διαδικασία εξετάζεται πλέον ξεχωριστά πριν επιτραπεί να επανεκκινήσει.

Η εταιρεία πραγματοποίησε επίσης παύση δύο εβδομάδων στο reinforcement learning των τελευταίων μοντέλων που προορίζονται για διάθεση. Στόχος ήταν να ενισχυθούν τα ερευνητικά περιβάλλοντα, να πραγματοποιηθούν επιθετικές δοκιμές ασφαλείας και να διευρυνθεί η κάλυψη των συστημάτων παρακολούθησης.

Σημαντικό μέρος των εργασιών που αφορούν το Astra παραμένει παγωμένο μέχρι να μεταφερθεί σε περιβάλλοντα που πληρούν τις νέες απαιτήσεις.

Μεταξύ των μέτρων περιλαμβάνονται ισχυρότερα sandboxes, αυστηρότερος διαχωρισμός από το διαδίκτυο, περιορισμένη πρόσβαση σε εργαλεία, κρυπτογράφηση των βαρών των μοντέλων και συνεχείς αυτοματοποιημένες δοκιμές των ορίων ασφαλείας.

Συναγερμός μέσα σε 30 λεπτά

Η OpenAI επεκτείνει παράλληλα την παρακολούθηση της συμπεριφοράς των μοντέλων σε όλα τα στάδια εκπαίδευσης και αξιολόγησης στα οποία χρησιμοποιούνται εργαλεία.

Το νέο σύστημα λειτουργεί σε διαδοχικά επίπεδα. Αρχικοί ανιχνευτές εξετάζουν συνεχώς τη δραστηριότητα του μοντέλου και, όταν εντοπίζουν ύποπτα σήματα, παραπέμπουν την υπόθεση σε ισχυρότερα αυτοματοποιημένα συστήματα διερεύνησης.

Οι μηχανισμοί ελέγχουν τις ενέργειες μέσω εργαλείων, τη διαθέσιμη συλλογιστική και ολόκληρη την ακολουθία της δραστηριότητας, αναζητώντας ενδείξεις μη εξουσιοδοτημένης πρόσβασης, κλοπής δεδομένων, καταστροφικής συμπεριφοράς ή προσπάθειας παράκαμψης των δικλίδων ασφαλείας.

Στόχος είναι να εκδίδεται ειδοποίηση μέσα σε 30 λεπτά από τον εντοπισμό μιας ανησυχητικής συμπεριφοράς. Εάν οι αρμόδιες ομάδες δεν μπορέσουν να αποδείξουν εντός του ίδιου διαστήματος ότι πρόκειται για λανθασμένο συναγερμό, η δραστηριότητα πρέπει να διακόπτεται.

Η ασφάλεια αυτή έχει σημαντικό κόστος. Η OpenAI εκτιμά ότι η παρακολούθηση απαιτεί περίπου 20% επιπλέον υπολογιστική ισχύ για τις διεργασίες στις οποίες εφαρμόζεται.

ΔΙΑΒΑΣΤΕ ΠΕΡΙΣΣΟΤΕΡΕΣ ΕΙΔΗΣΕΙΣ:

  • ΔΕΘ: Το νέο φορολογικό «deal» με τις επιχειρήσεις – Τι αλλάζει σε τεκμήρια και προκαταβολή φόρου
  • Γιατί η απόλυτη αισιοδοξία είναι… ανησυχητική – Η Wall Street ποντάρει στο τέλειο σενάριο
  • ΕΚΤ: Το βασικό σενάριο για τα επιτόκια και το «φάντασμα» του 2011 που επιστρέφει
  • Ευρωπαϊκές μετοχές: Τέλος στις «εύκολες» αποδόσεις – Πού βλέπει ευκαιρίες η JPMorgan

Επίλεξέ μας ως προτιμώμενη πηγή στο Google

Samsung και Volkswagen τελειώνουν τα κλειδιά αυτοκινήτου

Η Samsung και η Volkswagen αποφάσισαν να αφήσουν τα παραδοσιακά κλειδιά αυτοκινήτου στο παρελθόν . Οι δύο εταιρείες ενώνουν τις δυνάμεις τους για να προσφέρουν μια εμπειρία που λύνει τα χέρια των οδηγών . Πλέον, το μόνο που χρειάζεστε για να μπείτε στο όχημά σας και να βάλετε μπρος τη μηχανή είναι το Galaxy smartphone

Πότε θα μπουν τα ανθρωποειδή ρομπότ στα σπίτια μας;

Τα ρομπότ μπορούν ήδη να τρέχουν, να χορεύουν και να σηκώνουν αντικείμενα μπροστά στις κάμερες. Για να περάσουν, όμως, στη μαζική αγορά πρέπει να αποδείξουν ότι μπορούν να εκτελούν σωστά οκτώ στις δέκα καθημερινές εντολές, ακόμη και σε χώρους που δεν έχουν ξαναδεί. Το εντυπωσιακό βίντεο ενός ανθρωποειδούς ρομπότ που κάνει ανάποδη τούμπα μπορεί να