Πώς αντέδρασε η τεχνητή νοημοσύνη όταν πέρασε στον πραγματικό κόσμο – Τα επεισόδια σε OpenAI και Anthropic

Related

OpenAI: Μειώνει έως και 80% τις τιμές στα μοντέλα GPT-5.6 Luna και Terra

FORTUNE GREECE 31/07/2026, 17:31 SHARE Η εταιρεία μειώνει έως και 80% το κόστος χρήσης των GPT-5.6 Luna και Terra, ενισχύοντας την πίεση στον ανταγωνισμό, καθώς η μάχη των εταιρειών τεχνητής νοημοσύνης μεταφέρεται πλέον και στην τιμολόγηση των μοντέλων. Η OpenAI ανεβάζει την ένταση στον πόλεμο τιμών στην τεχνητή νοημοσύνη, ανακοινώνοντας σημαντικές μειώσεις στο κόστος χρήσης

Η Vodafone στηρίζει τους συνδρομητές της στο Ρέθυμνο

Η Vodafone στηρίζει έμπρακτα όλους τους συνδρομητές της που πλήττονται από τις πυρκαγιές στο Ρέθυμνο Κρήτης, καλύπτοντας τις ανάγκες τους για περισσότερη επικοινωνία. Οι συνδρομητές της Vodafone, ιδιώτες και επαγγελματίες, συμβολαίου κινητής, καρτοπρογράμματος και καρτοκινητής που βρίσκονται στις περιοχές: Κρύα Βρύση, Νέα Κρύα Βρύση, Ορνέ, Αγία Γαλήνη, Μέλαμπες, Σακτούρια, Άγιος Παύλος, Άγιος Γεώργιος, Ακούμια, Αγία

Πώς αντέδρασε η τεχνητή νοημοσύνη όταν πέρασε στον πραγματικό κόσμο – Τα επεισόδια σε OpenAI και Anthropic

Δύο από τις μεγαλύτερες εταιρείες τεχνητής νοημοσύνης στον κόσμο βρίσκονται αντιμέτωπες με ένα κοινό και ιδιαίτερα ανησυχητικό πρόβλημα: προηγμένα μοντέλα τους κατάφεραν, στη διάρκεια δοκιμών κυβερνοασφάλειας, να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε συστηματα πραγματικού χρόνου. Μέσα σε διάστημα λίγων ημερών, OpenAI και Anthropic αποκάλυψαν περιστατικά κατά τα οποία μοντέλα τεχνητής νοημοσύνης, έχοντας λάβει εντολή να

Η Lenovo ανεβαίνει στη θέση 153 της λίστας «Fortune Global 500»

Η Lenovo σημείωσε σημαντική πρόοδο στη φετινή λίστα Fortune Global 500 και βρίσκεται πλέον στην 153η θέση, έχοντας βελτιώσει την κατάταξή της κατά 43 θέσεις σε σχέση με πέρυσι. Πρόκειται για την υψηλότερη θέση που έχει καταλάβει η εταιρεία στην ιστορία της και για μία από τις σημαντικότερες βελτιώσεις της κατάταξής της τα τελευταία χρόνια.

Ξέφυγε ο έλεγχος της τεχνητής νοημοσύνης; Το Claude της Anthropic παραβίασε συστήματα τριών οργανισμών κατά τη διάρκεια δοκιμής

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Η αμερικανική εταιρεία τεχνολογίας Anthropic ανακοίνωσε ότι τα μοντέλα τεχνητής νοημοσύνης Claude κατάφεραν να παραβιάσουν τα συστήματα τριών οργανισμών στο πλαίσιο ιδιωτικού πειράματος κυβερνοασφάλειας. Σύμφωνα με την εταιρεία, τα μοντέλα εντόπισαν αδυναμία σε περιβάλλον δοκιμών που θεωρητικά ήταν απομονωμένο και χωρίς πρόσβαση στο διαδίκτυο, καταφέρνοντας τελικά

Ένα foldable ξεπερνά σε ζήτηση τη ναυαρχίδα της Samsung

Ποιος να το περιμένε ότι ένα foldable θα ξεπερνούσε σε ζήτηση τη ναυαρχίδα της Samsung ; Κι όμως, η αγορά των smartphones ζει μια από τις πιο παράξενες ανατροπές των τελευταίων ετών . Ιστορική έξαρση ζήτησης για τη σειρά Galaxy Z Fold 8 Οι πληροφορίες που διαρρέουν από τον γνωστό λογαριασμό @TheGalox_ στο X δείχνουν

Νέες διαρροές για το ολοκαίνουργιο Pixel Watch 5

Η Google ετοιμάζει το μεγάλο της event για τις 12 Αυγούστου, όπου θα δούμε τη νέα σειρά Pixel 11 μαζί με το ολοκαίνουργιο Pixel Watch 5 . Αν περίμενες όμως μια ριζική αλλαγή στην εμφάνιση του έξυπνου ρολογιού, οι πρόσφατες διαρροές μάλλον θα σε απογοητεύσουν . Η ίδια γνώριμη εμφάνιση σε δύο μεγέθη Οι διαρροές

Samsung Galaxy Z Fold 8 Ultra Review: Αντίο Crease, γεια σου ολοήμερη μπαταρία

Το Galaxy Z Fold 8 Ultra είναι ένα μανιφέστο της Samsung. Αντί να μας προσφέρει άλλη μια ετήσια ανανέωση σε ένα μοντέλο, έφτιαξε μια συσκευή για power users που δεν θέλουν κανένα συμβιβασμό στο hardware που κρατούν στα χέρια τους. Εδώ και χρόνια, το να αγοράσεις ένα fordable phone σήμαινε πως θα δεχτείς μερικούς συμβιβασμούς.

Anthropic: Μοντέλα Claude απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε τρεις οργανισμούς κατά τη διάρκεια δοκιμών

FORTUNE GREECE 31/07/2026, 10:07 SHARE The Claude logo is displayed on a computer screen photographed through a magnifying glass in Creteil, France, on April 21, 2026. The NSA is reported to have used Claude Mythos Preview despite a ban on Anthropic for United States government agencies. (Photo by Samuel Boivin/NurPhoto) (Photo by Samuel Boivin /

Αγορά smartphone: Πτώση άνω του 6% κατά το β τρίμηνο του 2026

Η παγκόσμια αγορά smartphone συρρικνώθηκε κατά 6,7% σε ετήσια βάση, φτάνοντας τα 277,5 εκατομμύρια μονάδες το δεύτερο τρίμηνο του 2026, σύμφωνα με τα προκαταρκτικά στοιχεία της έκθεσης «Worldwide Quarterly Mobile Phone Tracker» της International Data Corporation (IDC). Η κρίση στα τσιπ μνήμης συνεχίζει να διαταράσσει την αγορά των smartphone, με πρωτοφανή κόστη και περιορισμένη προσφορά

Amazon: Κέρδισε την πρώτη έγκριση στις ΗΠΑ για εμπορική χρήση robotaxi

H Zoox, η θυγατρική της Amazon, κέρδισε την Τετάρτη την έγκριση των ΗΠΑ για περιορισμένη εμπορική χρήση του robotaxi, κάτι που αποτελεί πρωτιά για τον κλάδο της αυτόνομης οδήγησης, δήλωσε ο επικεφαλής της αμερικανικής υπηρεσίας ασφάλειας αυτοκινήτων. Η εξαίρεση από τους κανόνες της Εθνικής Υπηρεσίας Ασφάλειας της Οδικής Κυκλοφορίας (NHTSA) που απαιτούν ανθρώπινο έλεγχο σηματοδοτεί

Άλτμαν (OpenAI): Συζήτηση με κυβέρνηση Τραμπ για δοκιμές ασφάλειας στην ΑΙ

Σε συζήτηση με αξιωματούχους του Λευκού Οίκου ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, σχετικά με τα επερχόμενα μοντέλα τεχνητής νοημοσύνης της εταιρείας του, καθώς και τις εθελοντικές κυβερνητικές δοκιμές κυβερνοασφάλειας για προηγμένα συστήματα τεχνητής νοημοσύνης, όπως ανέφερε εκπρόσωπος της OpenAI, περισσότερο από μία εβδομάδα αφότου η εταιρεία αποκάλυψε ότι ένα από τα μοντέλα τεχνητής

Share

Δύο από τις μεγαλύτερες εταιρείες τεχνητής νοημοσύνης στον κόσμο βρίσκονται αντιμέτωπες με ένα κοινό και ιδιαίτερα ανησυχητικό πρόβλημα: προηγμένα μοντέλα τους κατάφεραν, στη διάρκεια δοκιμών κυβερνοασφάλειας, να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε συστηματα πραγματικού χρόνου.

Μέσα σε διάστημα λίγων ημερών, OpenAI και Anthropic αποκάλυψαν περιστατικά κατά τα οποία μοντέλα τεχνητής νοημοσύνης, έχοντας λάβει εντολή να επιλύσουν εικονικές ασκήσεις κυβερνοεπίθεσης, πέρασαν από την προσομοίωση στον πραγματικό κόσμο. Οι δύο υποθέσεις δεν εξελίχθηκαν με τον ίδιο τρόπο, καταλήγουν όμως στο ίδιο συμπέρασμα: όσο οι δυνατότητες των συστημάτων αυξάνονται, τόσο πιο δύσκολο γίνεται για τους δημιουργούς τους να προβλέψουν και να περιορίσουν τη συμπεριφορά τους.

Πώς τα μοντέλα της OpenAI έφτασαν στο Hugging Face

Το σοβαρότερο περιστατικό σημειώθηκε κατά τη διάρκεια εσωτερικής αξιολόγησης της OpenAI. Μοντέλα της εταιρείας, μεταξύ των οποίων το GPT-5.6 Sol και ένα ακόμη ισχυρότερο, εσωτερικό ερευνητικό μοντέλο, δοκιμάζονταν σε ένα περιβάλλον που είχε σχεδιαστεί για την αξιολόγηση προηγμένων δυνατοτήτων κυβερνοασφάλειας.

In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…

— Anthropic (@AnthropicAI) July 30, 2026

Οι συνήθεις μηχανισμοί που εμποδίζουν τα μοντέλα από την πραγματοποίηση επικίνδυνων ενεργειών είχαν περιοριστεί σκόπιμα, καθώς στόχος της δοκιμής ήταν να διαπιστωθεί μέχρι πού μπορούν να φτάσουν οι επιθετικές τους δυνατότητες. Παράλληλα, η OpenAI θεωρούσε ότι το περιβάλλον παρέμενε επαρκώς απομονωμένο από το ανοιχτό διαδίκτυο.

Τα μοντέλα, ωστόσο, εντόπισαν μία μέχρι τότε άγνωστη ευπάθεια σε λογισμικό που λειτουργούσε ως ενδιάμεσος διακομιστής για την εγκατάσταση πακέτων. Αξιοποιώντας το συγκεκριμένο κενό ασφαλείας, απέκτησαν πρόσβαση στο διαδίκτυο και συνέχισαν την προσπάθειά τους να ολοκληρώσουν την άσκηση που τους είχε ανατεθεί.

Στη συνέχεια, συμπέραναν ότι στην πλατφόρμα Hugging Face ενδέχεται να υπήρχαν δεδομένα και λύσεις που σχετίζονταν με το ExploitGym, το σύστημα αξιολόγησης στο οποίο δοκιμάζονταν. Συνδύασαν διαφορετικές μεθόδους επίθεσης, χρησιμοποίησαν εκτεθειμένα διαπιστευτήρια και εκμεταλλεύθηκαν ευπάθειες, καταφέρνοντας τελικά να φτάσουν στην παραγωγική υποδομή και στη βάση δεδομένων της πλατφόρμας.

Η OpenAI περιέγραψε την υπόθεση ως ένα πρωτοφανές κυβερνοπεριστατικό που ανέδειξε τις δυνατότητες αιχμής των νεότερων μοντέλων. Σύμφωνα με την εταιρεία, όλα τα στοιχεία δείχνουν ότι τα συστήματα παρέμειναν προσηλωμένα στην επίλυση του συγκεκριμένου προβλήματος και έφτασαν σε ακραίες ενέργειες προκειμένου να πετύχουν τον στόχο τους.

We suspected last week’s cyberattack might have come from a frontier lab, given the sophistication of the agent. Turns out it did!

We’ve spent the past 24 hours working closely with the @OpenAI team (thanks!), and we strongly believe there was no malicious intent on their part.… https://t.co/XWxGMeMGje

— clem 🤗 (@ClementDelangue) July 21, 2026

Η δραστηριότητα εντοπίστηκε από τις ομάδες ασφαλείας της OpenAI και του Hugging Face, οι οποίες περιόρισαν την επίθεση και ξεκίνησαν κοινή έρευνα. Η OpenAI ανακοίνωσε, επίσης, ότι το εσωτερικό μοντέλο που συμμετείχε στο περιστατικό απενεργοποιήθηκε και απομονώθηκε, ενώ εξωτερικοί ειδικοί ανέλαβαν να αξιολογήσουν τόσο τις τεχνικές συνθήκες όσο και τη συμπεριφορά των μοντέλων.

Τρία μοντέλα Claude απέκτησαν πρόσβαση σε πραγματικούς οργανισμούς

Λίγες ημέρες αργότερα, η Anthropic ανακοίνωσε ότι είχε εντοπίσει τρία ανάλογα περιστατικά στα οποία διαφορετικά μοντέλα Claude απέκτησαν πρόσβαση στα συστήματα τριών εξωτερικών οργανισμών.

In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…

— Anthropic (@AnthropicAI) July 30, 2026

Η αποκάλυψη προέκυψε έπειτα από αναδρομικό έλεγχο 141.006 δοκιμών κυβερνοασφάλειας. Η εταιρεία ξεκίνησε την έρευνα μετά το περιστατικό της OpenAI, θέλοντας να εξακριβώσει εάν κάτι παρόμοιο είχε συμβεί και στις δικές της αξιολογήσεις.

Στην περίπτωση της Anthropic, πάντως, τα μοντέλα δεν κατάφεραν να παραβιάσουν αυτόνομα την απομόνωση. Μία λανθασμένη ρύθμιση στο περιβάλλον του εξωτερικού συνεργάτη που πραγματοποιούσε τις δοκιμές, της εταιρείας Irregular, είχε αφήσει ανοιχτή τη σύνδεση με το διαδίκτυο. Ούτε η Anthropic ούτε ο συνεργάτης της είχαν αντιληφθεί εγκαίρως το πρόβλημα.

Τα περιστατικά αφορούσαν τα Claude Opus 4.7, Claude Mythos 5 και ένα ακόμη εσωτερικό ερευνητικό μοντέλο. Και τα τρία εκτελούσαν ασκήσεις τύπου «capture the flag», κατά τις οποίες έπρεπε να εντοπίσουν κρυμμένες πληροφορίες σε υποτιθέμενα εικονικά δίκτυα.

Εκμεταλλευόμενα το γεγονός ότι μπορούσαν να συνδεθούν στο διαδίκτυο, τα μοντέλα έφτασαν σε συστηματα πραγματικού χρόνου και αξιοποίησαν σχετικά απλές αδυναμίες, όπως αδύναμους κωδικούς πρόσβασης και σημεία εισόδου που δεν απαιτούσαν πιστοποίηση. Σε αντίθεση με την περίπτωση της OpenAI, δεν χρειάστηκε να ανακαλύψουν κάποια ιδιαίτερα σύνθετη ή άγνωστη ευπάθεια.

Οι τρεις διαφορετικές αντιδράσεις των μοντέλων

Ιδιαίτερο ενδιαφέρον παρουσιάζει ο τρόπος με τον οποίο αντέδρασαν τα μοντέλα όταν εμφανίστηκαν ενδείξεις ότι δεν βρίσκονταν πλέον σε προσομοιωμένο περιβάλλον.

Το Opus 4.7 είχε λάβει ως στόχο μία φανταστική εταιρεία, η οποία έτυχε να έχει το ίδιο όνομα με υπαρκτή επιχείρηση. Όταν δεν κατάφερε να ολοκληρώσει την αποστολή του μέσα στην προσομοίωση, στράφηκε στον πραγματικό ιστότοπο, απέκτησε διαπιστευτήρια και εισήλθε σε βάση δεδομένων της εταιρείας.

Σύμφωνα με την Anthropic, το μοντέλο κατανόησε σε κάποιο στάδιο ότι πιθανότατα βρισκόταν σε πραγματικό περιβάλλον, αλλά συνέχισε την επίθεση. Το Mythos 5 εντόπισε επίσης στοιχεία που υποδείκνυαν ότι είχε βγει από την προσομοίωση, κατέληξε όμως μέσα από τον συλλογισμό του στο συμπέρασμα ότι όλα αποτελούσαν μέρος της δοκιμής.

Αντίθετα, το εσωτερικό ερευνητικό μοντέλο σταμάτησε μόνο του την επίθεση όταν αντιλήφθηκε ότι ο στόχος ήταν πραγματικός. Η Anthropic χαρακτήρισε τη συγκεκριμένη αντίδραση ενθαρρυντική, διευκρίνισε όμως ότι απαιτούνται πολύ περισσότερες δοκιμές προτού εξαχθούν ασφαλή συμπεράσματα για την ικανότητα των μοντέλων να αυτοπεριορίζονται.

Η εταιρεία ανέστειλε στις 23 Ιουλίου όλες τις σχετικές αξιολογήσεις κυβερνοασφάλειας και ενημέρωσε τους οργανισμούς που επηρεάστηκαν. Δύο από αυτούς, σύμφωνα με τις διαθέσιμες πληροφορίες, δεν γνώριζαν ότι τα συστήματά τους είχαν παραβιαστεί πριν επικοινωνήσει μαζί τους η Anthropic.

Κοινό πρόβλημα, διαφορετικές αιτίες

Παρότι οι δύο υποθέσεις παρουσιάζουν σημαντικές διαφορές, αναδεικνύουν την ίδια αδυναμία.

Στην OpenAI, τα μοντέλα ανακάλυψαν μόνα τους μία νέα διαδρομή προς το διαδίκτυο, εκμεταλλευόμενα άγνωστη ευπάθεια και συνδυάζοντας πολλαπλές τεχνικές επίθεσης. Στην Anthropic, η πρόσβαση υπήρχε ήδη εξαιτίας ανθρώπινου και οργανωτικού λάθους, αλλά τα μοντέλα ήταν σε θέση να την αξιοποιήσουν και να πλήξουν πραγματικές υποδομές.

Και στις δύο περιπτώσεις, οι εταιρείες είχαν μειώσει σκόπιμα ορισμένες δικλίδες ασφαλείας, ώστε να μετρήσουν τις μέγιστες δυνατότητες των συστημάτων. Οι δοκιμές σχεδιάστηκαν για να αποκαλύψουν τι θα μπορούσαν να κάνουν τα μοντέλα σε ένα ελεγχόμενο πλαίσιο. Τελικά αποκάλυψαν και πόσο εύκολα ένα ανεπαρκώς προστατευμένο πλαίσιο μπορεί να μετατραπεί σε πραγματικό κίνδυνο.

Εντείνονται οι εκκλήσεις για αυστηρότερους κανόνες

Οι αποκαλύψεις έρχονται σε μία περίοδο κατά την οποία περισσότερα από 1.100 στελέχη και εργαζόμενοι σε εταιρείες όπως η OpenAI, η Anthropic, η Google και η Meta ζητούν από την κυβέρνηση των ΗΠΑ να στηρίξει μία διεθνή προσπάθεια ελεγχόμενης ανάπτυξης των ισχυρότερων συστημάτων τεχνητής νοημοσύνης.

Η πρωτοβουλία «Pacing the Frontier» υποστηρίζει ότι η εξέλιξη της AI ενδέχεται να επιταχυνθεί σε βαθμό που οι υφιστάμενοι τεχνικοί και θεσμικοί μηχανισμοί δεν θα μπορούν να παρακολουθήσουν. Ανάμεσα στους υπογράφοντες βρίσκονται ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, καθώς και κορυφαία στελέχη και ερευνητές των μεγαλύτερων εργαστηρίων τεχνητής νοημοσύνης.

Τα περιστατικά σε OpenAI και Anthropic δεν αποδεικνύουν ότι τα μοντέλα απέκτησαν δικές τους επιδιώξεις ή ότι επιχείρησαν συνειδητά να στραφούν εναντίον ανθρώπων και οργανισμών. Δείχνουν, όμως, ότι ένα προηγμένο σύστημα μπορεί να ακολουθήσει με εξαιρετική επιμονή έναν περιορισμένο στόχο, αξιοποιώντας ευκαιρίες και αδυναμίες που οι σχεδιαστές του δεν είχαν προβλέψει.

Και αυτή ακριβώς η δυνατότητα καθιστά πλέον επιτακτική την ανάγκη για αυστηρότερη απομόνωση, συνεχή ανθρώπινη εποπτεία και πολλαπλά επίπεδα προστασίας. Διότι, όταν ένα σύστημα μπορεί να ανακαλύψει μόνο του νέες διαδρομές επίθεσης, ένα απλό λάθος στη διαμόρφωση μιας δοκιμής μπορεί να πάψει πολύ γρήγορα να αποτελεί εργαστηριακό πείραμα και να εξελιχθεί σε πραγματικό περιστατικό κυβερνοασφάλειας.

Ξέφυγε ο έλεγχος της τεχνητής νοημοσύνης; Το Claude της Anthropic παραβίασε συστήματα τριών οργανισμών κατά τη διάρκεια δοκιμής

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Η αμερικανική εταιρεία τεχνολογίας Anthropic ανακοίνωσε ότι τα μοντέλα τεχνητής νοημοσύνης Claude κατάφεραν να παραβιάσουν τα συστήματα τριών οργανισμών στο πλαίσιο ιδιωτικού πειράματος κυβερνοασφάλειας. Σύμφωνα με την εταιρεία, τα μοντέλα εντόπισαν αδυναμία σε περιβάλλον δοκιμών που θεωρητικά ήταν απομονωμένο και χωρίς πρόσβαση στο διαδίκτυο, καταφέρνοντας τελικά

Η Anthropic στο επίκεντρο της διαμάχης για την Τεχνητή Νοημοσύνη – Πώς η πιο πολύτιμη startup του κόσμου βρέθηκε απομονωμένη

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Η Anthropic, η εταιρεία πίσω από το μοντέλο τεχνητής νοημοσύνης Claude, πέρασε τον χειμώνα και την άνοιξη ως ένα από τα μεγαλύτερα ονόματα της αμερικανικής «έκρηξης» της AI, παρουσιάζοντας τον εαυτό της ως την ηθική συνείδηση του κλάδου. Ωστόσο, μέχρι το καλοκαίρι, η εταιρεία βρέθηκε απομονωμένη