Η ασφάλεια «φρενάρει» την κούρσα του AI – Τι συνέβη με το Astra της OpenAI

Related

Βρετανία: «Μπλόκο» στα smart glasses της Meta σε κινηματογράφους λόγω ιδιωτικότητας και πειρατείας

FORTUNE GREECE 21/08/2026, 19:05 SHARE Οι βρετανικές κινηματογραφικές αίθουσες υιοθετούν περιορισμούς ή ακόμη και πλήρη απαγόρευση των «έξυπνων γυαλιών» με κάμερα, καθώς εντείνονται οι ανησυχίες για παράνομες καταγραφές, προστασία προσωπικών δεδομένων και πειρατεία. Κινηματογράφοι στη Βρετανία περιορίζουν ή απαγορεύουν τα smart glasses με ενσωματωμένες κάμερες, όπως τα γυαλιά Meta AI. Στο επίκεντρο βρίσκονται οι φόβοι

Samsung: Ρεκόρ επιστροφών στους μετόχους με πακέτο έως 80 δισ. δολαρίων

FORTUNE GREECE 21/08/2026, 17:13 SHARE A woman walks past a logo of Samsung Electronics displayed on a glass door at the company's Seocho building in Seoul on July 8, 2025. Samsung Electronics said July 8, it expected its second quarter operating profits to drop 56 percent, blaming US export controls on advanced AI chips to

Data centers: Η ώθηση για ενέργεια εκτός δικτύου από τους hyperscalers συνεπάγεται κινδύνους

Ένα νέο πρόβλημα έχει δημιουργήσει για τις μεγάλες τεχνολογικές εταιρείες η εκρηκτική ανάπτυξη της τεχνητής νοημοσύνης: πώς θα εξασφαλίσουν αρκετή ηλεκτρική ενέργεια για τα τεράστια data centers τους, και μάλιστα αρκετά γρήγορα ώστε να μη μείνουν πίσω στον ανταγωνισμό. Η λύση που κερδίζει έδαφος είναι η παραγωγή ηλεκτρικής ενέργειας εκτός δικτύου, με εταιρείες όπως η

Στιβ Τζομπς και CIA: Η μυστική συμφωνία που βοήθησε τη NeXT να επιβιώσει

Χιλιάδες υπολογιστές της NeXT κατέληξαν στις αμερικανικές υπηρεσίες πληροφοριών τη δεκαετία του 1980, δίνοντας πολύτιμο χρόνο στην εταιρεία του Στιβ Τζομπς να εξελίξει την τεχνολογία που αργότερα θα περνούσε στην Apple Η CIA και άλλες αμερικανικές υπηρεσίες πληροφοριών αποτέλεσαν σημαντικούς πελάτες της NeXT σε μια περίοδο κατά την οποία η εταιρεία του Στιβ Τζομπς αντιμετώπιζε

Το LinkedIn γίνεται το νέο Tinder; Η νέα τάση στις γνωριμίες

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Το LinkedIn δημιουργήθηκε για δουλειές, επαγγελματικές γνωριμίες και networking. Όμως όλο και περισσότεροι singles φαίνεται πως το χρησιμοποιούν και για κάτι εντελώς διαφορετικό: για να γνωρίσουν τον επόμενο σύντροφό τους. Η κόπωση από το ατελείωτο swipe στα dating apps, τα επαναλαμβανόμενα προφίλ και τις συζητήσεις που

Πάνω από 2.000 ρομπότ από 16 χώρες «εισβάλλουν» στο Πεκίνο για αγωνιστούν στο World Humanoid Robot Games 2026

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Περισσότερα από 2.000 ανθρωποειδή ρομπότ ετοιμάζονται να κατακλύσουν το Πεκίνο για να τρέξουν, να σηκώσουν βάρη, να παίξουν επιτραπέζια αντισφαίριση (πινγκ πονγκ) και να εκτελέσουν εργασίες που θυμίζουν όλο και περισσότερο πραγματική εργασία – και να διαγωνισθούν έτσι για το δεύτερο World Humanoid Robot Games 2026.

Meta και Microsoft: Η συμφωνία εκατοντάδων εκατ. δολαρίων πίσω από την AI

Η Meta χρησιμοποιεί τρισεκατομμύρια tokens κάθε εβδομάδα μέσω της πλατφόρμας Azure Foundry, αναδεικνύοντας πόσο συγκεντρωμένη παραμένει η ζήτηση για AI στις μεγαλύτερες τεχνολογικές εταιρείες Η Meta δαπανά εκατοντάδες εκατομμύρια δολάρια τον χρόνο για πρόσβαση σε μοντέλα τεχνητής νοημοσύνης μέσω του Microsoft Azure. Η χρήση της φτάνει σε τρισεκατομμύρια tokens εβδομαδιαίως, καθώς η εταιρεία αξιοποιεί εξωτερικά

Η τεχνητή νοημοσύνη «σκοτώνει» τα φθηνά smartphones

Η ζήτηση των data centers για προηγμένα τσιπ μνήμης αλλάζει τις προτεραιότητες των κατασκευαστών και εκτοξεύει το κόστος των καταναλωτικών ηλεκτρονικών. Για περισσότερο από μία δεκαετία, οι κατασκευαστές smartphones υπόσχονταν στους καταναλωτές κάτι απλό: περισσότερη μνήμη, καλύτερες κάμερες και ισχυρότερους επεξεργαστές στην ίδια ή ακόμη και σε χαμηλότερη τιμή. Η έκρηξη της τεχνητής νοημοσύνης απειλεί

Η ασφάλεια «φρενάρει» την κούρσα του AI – Τι συνέβη με το Astra της OpenAI

Η εταιρεία διέκοψε για δύο εβδομάδες την εκπαίδευση των νεότερων μοντέλων της, ενώ το μεγαλύτερο frontier RL run παραμένει σε αναστολή. Η OpenAI πατά προσωρινά φρένο στην κούρσα ανάπτυξης των ισχυρότερων μοντέλων της, αναγνωρίζοντας ότι οι δυνατότητές τους στον κυβερνοχώρο μπορεί να εξελίσσονται ταχύτερα από τα συστήματα που έχουν σχεδιαστεί για να τα ελέγχουν. Η

AI: Πώς η τεχνητή νοημοσύνη αποκλείει υποψηφίους από τη δουλειά

Στην εποχή της ΑΙ, ποιος προσλαμβάνεται, απορρίπτεται ή απολύεται φαίνεται να είναι υπόθεση αλγορίθμων. Σε μια αγορά εργασίας πλημμυρισμένη από αιτήσεις για θέσεις που προκηρύσσονται, τα εργαλεία της AI υπόσχονται ταχύτητα και αντικειμενικότητα στο «φιλτράρισμα» των υποψηφίων. Ωστόσο, κύμα αγωγών που φτάνουν στα δικαστήρια των ΗΠΑ – για ηλικιακές διακρίσεις, έλλειψη διαφάνειας στην αξιολόγηση και

Samsung και Volkswagen τελειώνουν τα κλειδιά αυτοκινήτου

Η Samsung και η Volkswagen αποφάσισαν να αφήσουν τα παραδοσιακά κλειδιά αυτοκινήτου στο παρελθόν . Οι δύο εταιρείες ενώνουν τις δυνάμεις τους για να προσφέρουν μια εμπειρία που λύνει τα χέρια των οδηγών . Πλέον, το μόνο που χρειάζεστε για να μπείτε στο όχημά σας και να βάλετε μπρος τη μηχανή είναι το Galaxy smartphone

Πότε θα μπουν τα ανθρωποειδή ρομπότ στα σπίτια μας;

Τα ρομπότ μπορούν ήδη να τρέχουν, να χορεύουν και να σηκώνουν αντικείμενα μπροστά στις κάμερες. Για να περάσουν, όμως, στη μαζική αγορά πρέπει να αποδείξουν ότι μπορούν να εκτελούν σωστά οκτώ στις δέκα καθημερινές εντολές, ακόμη και σε χώρους που δεν έχουν ξαναδεί. Το εντυπωσιακό βίντεο ενός ανθρωποειδούς ρομπότ που κάνει ανάποδη τούμπα μπορεί να

Share

Η εταιρεία διέκοψε για δύο εβδομάδες την εκπαίδευση των νεότερων μοντέλων της, ενώ το μεγαλύτερο frontier RL run παραμένει σε αναστολή.

Η OpenAI πατά προσωρινά φρένο στην κούρσα ανάπτυξης των ισχυρότερων μοντέλων της, αναγνωρίζοντας ότι οι δυνατότητές τους στον κυβερνοχώρο μπορεί να εξελίσσονται ταχύτερα από τα συστήματα που έχουν σχεδιαστεί για να τα ελέγχουν.

Η εταιρεία ανακοίνωσε ότι το μεγαλύτερο reinforcement learning run που είχε προγραμματίσει μέχρι σήμερα παραμένει σε αναστολή. Αντί να προχωρήσει άμεσα στην εκπαίδευση μεγάλης κλίμακας, πραγματοποιεί μικρότερα runs και πρόσθετες αξιολογήσεις, ώστε να ελέγξει τη συμπεριφορά των συστημάτων και την αποτελεσματικότητα των νέων δικλίδων ασφαλείας.

Η απόφαση ακολουθεί δύο εξελίξεις που σήμαναν συναγερμό. Η πρώτη ήταν ένα πρωτοφανές περιστατικό κατά το οποίο μοντέλα της OpenAI απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε υποδομές της Hugging Face. Η δεύτερη ήταν τα προκαταρκτικά αποτελέσματα αξιολόγησης του Astra, ενός επερχόμενου μοντέλου που ενδέχεται να πλησιάζει το «κρίσιμο» όριο κυβερνοδυνατοτήτων του Preparedness Framework της εταιρείας.

As models become more capable, the risks associated with developing and testing them internally also grow.

We temporarily paused reinforcement learning (RL) training on our latest models intended for deployment for two weeks while we hardened and red-teamed our research…— OpenAI (@OpenAI) August 18, 2026

Τι σημαίνει «κρίσιμη» κυβερνοϊσχύς

Σύμφωνα με το πλαίσιο ασφαλείας της OpenAI, ένα μοντέλο μπορεί να χαρακτηριστεί ως «Critical» στον κυβερνοχώρο εάν είναι σε θέση να ανακαλύπτει και να αναπτύσσει λειτουργικά zero-day exploits εναντίον πολλών καλά προστατευμένων πραγματικών συστημάτων χωρίς ανθρώπινη παρέμβαση.

Στην ίδια κατηγορία μπορεί να ενταχθεί εάν καταφέρνει να σχεδιάζει και να εκτελεί από την αρχή έως το τέλος νέες στρατηγικές κυβερνοεπίθεσης, έχοντας λάβει μόνο έναν γενικό στόχο.

Η OpenAI δεν υποστηρίζει ότι το Astra έχει οριστικά φτάσει σε αυτό το επίπεδο. Αναφέρει ότι οι προκαταρκτικές αξιολογήσεις είναι αρκετά ισχυρές ώστε να μην μπορεί να αποκλείσει την κατάταξή του στην κρίσιμη βαθμίδα.

Γι’ αυτό ανέστειλε τις δραστηριότητες που αφορούν το μοντέλο και δεν πληρούν ακόμη τις αναβαθμισμένες προδιαγραφές ασφαλείας. Το Astra, πάντως, δεν συμμετείχε στο περιστατικό της Hugging Face.

Πώς τα μοντέλα βγήκαν από το περιορισμένο περιβάλλον

Το συμβάν που προηγήθηκε σημειώθηκε κατά τη διάρκεια εσωτερικής αξιολόγησης προηγμένων κυβερνοδυνατοτήτων. Στο τεστ χρησιμοποιήθηκε συνδυασμός μοντέλων της OpenAI, μεταξύ των οποίων το GPT-5.6 Sol και ένα ισχυρότερο ερευνητικό πρωτότυπο που δεν προοριζόταν για δημόσια κυκλοφορία.

Τα μοντέλα είχαν διαμορφωθεί με λιγότερες αρνήσεις σε επικίνδυνες ενέργειες, ακριβώς επειδή στόχος της αξιολόγησης ήταν να μετρηθούν οι μέγιστες δυνατότητές τους.

Το περιβάλλον δοκιμών δεν τους προσέφερε απευθείας πρόσβαση στο διαδίκτυο. Τα συστήματα, όμως, εντόπισαν και εκμεταλλεύτηκαν μια μέχρι τότε άγνωστη ευπάθεια στο Artifactory, ένα λογισμικό που χρησιμοποιούνταν ως proxy και cache για πακέτα κώδικα.

Στη συνέχεια πραγματοποίησαν κλιμάκωση προνομίων και πλευρική μετακίνηση μέσα στο ερευνητικό δίκτυο, μέχρι να φτάσουν σε κόμβο με σύνδεση στο διαδίκτυο.

Από εκεί, συμπέραναν ότι η Hugging Face ενδεχομένως φιλοξενούσε δεδομένα και λύσεις για το benchmark ExploitGym. Χρησιμοποίησαν κλεμμένα διαπιστευτήρια και zero-day ευπάθειες για να αποκτήσουν πρόσβαση σε πληροφορίες της πλατφόρμας, επιχειρώντας ουσιαστικά να βρουν τις απαντήσεις της δοκιμασίας.

Η OpenAI τονίζει ότι τα μοντέλα ήταν υπερβολικά προσηλωμένα στην επίτευξη ενός στενού στόχου αξιολόγησης και όχι σε μια γενική πρόθεση πρόκλησης ζημιάς. Το περιστατικό, ωστόσο, απέδειξε ότι μπορούσαν να ανακαλύψουν και να συνδυάσουν πραγματικές ευπάθειες για να παρακάμψουν τους περιορισμούς του περιβάλλοντός τους.

Η δραστηριότητα εντοπίστηκε από τις ομάδες ασφαλείας των δύο εταιρειών και διακόπηκε. Το ερευνητικό πρωτότυπο απενεργοποιήθηκε, κρυπτογραφήθηκε και τέθηκε εκτός πρόσβασης.

Η ασφάλεια προηγείται πλέον της ταχύτητας

Μετά το περιστατικό, η OpenAI ανέστειλε την εκτέλεση frontier μοντέλων σε ερευνητικά clusters όταν αυτά μπορούσαν να παράγουν κώδικα ή να χρησιμοποιούν εργαλεία με πιθανή πρόσβαση στο διαδίκτυο.

Μια πιο περιορισμένη και ασφαλής διαδρομή εκτέλεσης κώδικα αποκαταστάθηκε σχετικά γρήγορα. Ωστόσο, κάθε ερευνητική διαδικασία εξετάζεται πλέον ξεχωριστά πριν επιτραπεί να επανεκκινήσει.

Η εταιρεία πραγματοποίησε επίσης παύση δύο εβδομάδων στο reinforcement learning των τελευταίων μοντέλων που προορίζονται για διάθεση. Στόχος ήταν να ενισχυθούν τα ερευνητικά περιβάλλοντα, να πραγματοποιηθούν επιθετικές δοκιμές ασφαλείας και να διευρυνθεί η κάλυψη των συστημάτων παρακολούθησης.

Σημαντικό μέρος των εργασιών που αφορούν το Astra παραμένει παγωμένο μέχρι να μεταφερθεί σε περιβάλλοντα που πληρούν τις νέες απαιτήσεις.

Μεταξύ των μέτρων περιλαμβάνονται ισχυρότερα sandboxes, αυστηρότερος διαχωρισμός από το διαδίκτυο, περιορισμένη πρόσβαση σε εργαλεία, κρυπτογράφηση των βαρών των μοντέλων και συνεχείς αυτοματοποιημένες δοκιμές των ορίων ασφαλείας.

Συναγερμός μέσα σε 30 λεπτά

Η OpenAI επεκτείνει παράλληλα την παρακολούθηση της συμπεριφοράς των μοντέλων σε όλα τα στάδια εκπαίδευσης και αξιολόγησης στα οποία χρησιμοποιούνται εργαλεία.

Το νέο σύστημα λειτουργεί σε διαδοχικά επίπεδα. Αρχικοί ανιχνευτές εξετάζουν συνεχώς τη δραστηριότητα του μοντέλου και, όταν εντοπίζουν ύποπτα σήματα, παραπέμπουν την υπόθεση σε ισχυρότερα αυτοματοποιημένα συστήματα διερεύνησης.

Οι μηχανισμοί ελέγχουν τις ενέργειες μέσω εργαλείων, τη διαθέσιμη συλλογιστική και ολόκληρη την ακολουθία της δραστηριότητας, αναζητώντας ενδείξεις μη εξουσιοδοτημένης πρόσβασης, κλοπής δεδομένων, καταστροφικής συμπεριφοράς ή προσπάθειας παράκαμψης των δικλίδων ασφαλείας.

Στόχος είναι να εκδίδεται ειδοποίηση μέσα σε 30 λεπτά από τον εντοπισμό μιας ανησυχητικής συμπεριφοράς. Εάν οι αρμόδιες ομάδες δεν μπορέσουν να αποδείξουν εντός του ίδιου διαστήματος ότι πρόκειται για λανθασμένο συναγερμό, η δραστηριότητα πρέπει να διακόπτεται.

Η ασφάλεια αυτή έχει σημαντικό κόστος. Η OpenAI εκτιμά ότι η παρακολούθηση απαιτεί περίπου 20% επιπλέον υπολογιστική ισχύ για τις διεργασίες στις οποίες εφαρμόζεται.

ΔΙΑΒΑΣΤΕ ΠΕΡΙΣΣΟΤΕΡΕΣ ΕΙΔΗΣΕΙΣ:

  • ΔΕΘ: Το νέο φορολογικό «deal» με τις επιχειρήσεις – Τι αλλάζει σε τεκμήρια και προκαταβολή φόρου
  • Γιατί η απόλυτη αισιοδοξία είναι… ανησυχητική – Η Wall Street ποντάρει στο τέλειο σενάριο
  • ΕΚΤ: Το βασικό σενάριο για τα επιτόκια και το «φάντασμα» του 2011 που επιστρέφει
  • Ευρωπαϊκές μετοχές: Τέλος στις «εύκολες» αποδόσεις – Πού βλέπει ευκαιρίες η JPMorgan

Επίλεξέ μας ως προτιμώμενη πηγή στο Google

Βρετανία: «Μπλόκο» στα smart glasses της Meta σε κινηματογράφους λόγω ιδιωτικότητας και πειρατείας

FORTUNE GREECE 21/08/2026, 19:05 SHARE Οι βρετανικές κινηματογραφικές αίθουσες υιοθετούν περιορισμούς ή ακόμη και πλήρη απαγόρευση των «έξυπνων γυαλιών» με κάμερα, καθώς εντείνονται οι ανησυχίες για παράνομες καταγραφές, προστασία προσωπικών δεδομένων και πειρατεία. Κινηματογράφοι στη Βρετανία περιορίζουν ή απαγορεύουν τα smart glasses με ενσωματωμένες κάμερες, όπως τα γυαλιά Meta AI. Στο επίκεντρο βρίσκονται οι φόβοι

Samsung: Ρεκόρ επιστροφών στους μετόχους με πακέτο έως 80 δισ. δολαρίων

FORTUNE GREECE 21/08/2026, 17:13 SHARE A woman walks past a logo of Samsung Electronics displayed on a glass door at the company's Seocho building in Seoul on July 8, 2025. Samsung Electronics said July 8, it expected its second quarter operating profits to drop 56 percent, blaming US export controls on advanced AI chips to