Πώς αντέδρασε η τεχνητή νοημοσύνη όταν πέρασε στον πραγματικό κόσμο – Τα επεισόδια σε OpenAI και Anthropic

Related

Τεχνητή Νοημοσύνη: Τα τέσσερα εμπόδια για data centers στο διάστημα

Με τις κοινωνικές αντιδράσεις κατά της κατασκευής ενεργοβόρων κέντρων δεδομένων για την Τεχνητή Νοημοσύνη να εξαπλώνονται στις ΗΠΑ, οι εταιρείες, ενώ αρχικά άρχισαν να εξαπλώνονται στην έρημο, τώρα σκέφτονται ακόμη και το διάστημα. Τα τροχιακά κέντρα δεδομένων θα μπορούσαν να συμβάλουν στην μαζική ανάπτυξη της Τεχνητής Νοημοσύνης, λέει το CNBC, αλλά πρέπει να συμβούν αρκετές

Τεχνητή Νοημοσύνη: Δεν απειλεί τους σχεδιαστές – αλλάζει τη δουλειά τους

Οι επαγγελματίες σχεδιαστές δεν θα πρέπει να αντιμετωπίζουν την παραγωγική Τεχνητή Νοημοσύνη ως απειλή για τις θέσεις εργασίας τους, υποστηρίζουν στελέχη του κλάδου, εκτιμώντας ότι οι επιχειρήσεις είναι πιθανότερο να χρησιμοποιήσουν την τεχνολογία ως εργαλείο ενίσχυσης της ανθρώπινης εργασίας παρά ως υποκατάστατό της. Η Τεχνητή Νοημοσύνη έχει ήδη αρχίσει να αλλάζει τον τρόπο με τον

Data Centers: Επενδύσεις 31,6 τρισ. δολ. έως το 2050 λόγω της «έκρηξης» της ΑΙ

Πρωτοφανείς διαστάσεις αναμένεται να λάβουν οι επενδύσεις σε κέντρα δεδομένων (data centers) τις επόμενες δεκαετίες, καθώς η παγκόσμια οικονομία προσαρμόζεται στην ταχύτατη εξάπλωση της τεχνητής νοημοσύνης. Σύμφωνα με την PwC, οι συνολικές δαπάνες για data centers παγκοσμίως εκτιμάται ότι θα φτάσουν τα 31,6 τρισ. δολάρια έως το 2050, σε έναν επενδυτικό κύκλο που, όπως επισημαίνει

Απολύθηκαν εξαιτίας της AI και τώρα δημιούργησαν ένα εργαλείο που αντικαθιστά τον CEO

FORTUNE GREECE 07/09/2026, 22:01 SHARE Μηχανικοί λογισμικού που υποστηρίζουν ότι απολύθηκαν εξαιτίας της τεχνητής νοημοσύνης δημιούργησαν το OpenExecutive, ένα open-source σύστημα βασισμένο στα μοντέλα Claude της Anthropic, το οποίο επιστρατεύει οκτώ AI agents για να εκτελεί καθήκοντα CEO και ανώτατων στελεχών. Μια ομάδα μηχανικών που δηλώνει ότι απολύθηκε εξαιτίας της τεχνητής νοημοσύνης δημιούργησε το OpenExecutive

Η επανάσταση των μηχανών ξεκίνησε: Ρομπότ διαδηλώνουν στην Πολωνία ζητώντας προστασία των θέσεων εργασίας από την τεχνητή νοημοσύνη

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Μια εικόνα που μοιάζει βγαλμένη από ταινία επιστημονικής φαντασίας εκτυλίχθηκε στην Πολωνία, όπου περίπου τριάντα ρομπότ προχώρησαν σε διαμαρτυρία έξω από το υπουργείο Ψηφιακής Πολιτικής. Κρατώντας σημαίες και φωνάζοντας συνθήματα σαν έμπειροι ακτιβιστές, τα ρομπότ εξέφρασαν την έντονη ανησυχία τους για τις αλλαγές που φέρνει η

AI data centers: Οι δισεκατομμυριούχοι της τεχνολογίας ρίχνουν εκατομμύρια για να αλλάξουν την κοινή γνώμη

FORTUNE GREECE 07/09/2026, 19:31 SHARE Δισεκατομμυριούχοι της τεχνολογίας και κορυφαία στελέχη της AI χρηματοδοτούν εκστρατεία εκατομμυρίων υπέρ των data centers σε κρίσιμες αμερικανικές πολιτείες, την ώρα που το 61% των πολιτών αντιτίθεται στην κατασκευή νέων εγκαταστάσεων κοντά στον τόπο κατοικίας του. Η Build American AI, με τη στήριξη ισχυρών παραγόντων της τεχνολογίας, ξεκινά διαφημιστική εκστρατεία

Crypto hack 320 εκατ. δολαρίων: Έκαναν «φτερά» 4.000 Bitcoin

FORTUNE GREECE 07/09/2026, 17:20 SHARE Σχεδόν 4.000 Bitcoin, αξίας περίπου 320 εκατ. δολαρίων, αποσύρθηκαν χωρίς εξουσιοδότηση από το wallet της Liquid Federation, αναγκάζοντας το Liquid Network να αναστείλει τις νέες συναλλαγές ενώ διερευνά την παραβίαση. Περίπου 4.000 από τα 4.200 Bitcoin του wallet της Liquid Federation αποσύρθηκαν, ποσότητα που αντιστοιχεί σχεδόν στο 95% των συγκεκριμένων

Η Τεχνητή Νοημοσύνη ξεφεύγει; «Δεν είναι κανείς προετοιμασμένος για όσα έρχονται», προειδοποιεί η OpenAI

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Ο επικεφαλής επιστήμονας της OpenAI, Γιάκουμπ Πατσότσκι, ζητά «ακραία προσοχή» απέναντι στην ανεξέλεγκτη πρόοδο της τεχνητής νοημοσύνης, προειδοποιώντας ότι ενδέχεται να χρειαστούν περισσότερες παρεμβάσεις, ώστε «οι άνθρωποι να παραμείνουν στον έλεγχο του μέλλοντος». «Ανησυχώ ότι κανείς δεν είναι προετοιμασμένος για τις συνέπειες μιας συνεχιζόμενης ταχείας αύξησης

IFA 2026: Τα ρομπότ γίνονται πιο έξυπνα, πιο αυτόνομα και πιο χρήσιμα

Αποστολή στο Βερολίνο Χορεύουν, κάνουν backflip, ανταλλάσσουν χειρονομίες με τους επισκέπτες, μεταφέρουν αντικείμενα και εκτελούν ακολουθίες εργασιών που, πριν από λίγα χρόνια, απαιτούσαν αυστηρά ελεγχόμενο εργαστηριακό περιβάλλον. Στην IFA 2026, η ρομποτική έχει αποκτήσει πολύ μεγαλύτερη παρουσία και, κυρίως, πιο συγκεκριμένο ρόλο. Στον εκθεσιακό χώρο του Messe Berlin, τα ρομπότ αποτελούν μέρος μιας ευρύτερης τεχνολογικής

Η Lenovo διευρύνει τις δυνατότητες του Hybrid AI για επιχειρήσεις με νέες συσκευές Think, οθόνες και λύσεις ασφαλείας (IFA 2026)

Καθώς το AI ενσωματώνεται όλο και περισσότερο στον χώρο εργασίας, οι οργανισμοί χρειάζονται λύσεις που δεν προσφέρουν μόνο ισχυρή απόδοση, αλλά υποστηρίζουν και τον τρόπο με τον οποίο εργάζεται το προσωπικό τους. Στην εκδήλωση Lenovo Innovation World, στο πλαίσιο της IFA 2026, η Lenovo™ παρουσίασε το νέο εμπορικό της portfolio, το οποίο εξελίσσει το Hybrid

IFA 2026: Το beauty tech είναι το επόμενο μεγάλο κεφάλαιο των ηλεκτρονικών

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Αποστολή στο Βερολίνο Μια αγορά κοντά στα 90 δισ. δολάρια χρειάζεται χώρο για να δείξει τον εαυτό της. Φέτος τον βρήκε στο Hall 13 της IFA 2026, στο Messe Berlin, εκεί όπου το Beauty Hub μετατράπηκε σε ζωντανό εργαστήριο, με τους επισκέπτες να παίρνουν τις συσκευές

ΡΕΪΒ ΠΑΝΗΓΥΡΙ Vol. 2: Tο πιο ανατρεπτικό μουσικό event επιστρέφει από το Vodafone CU!

Το Vodafone CU φέρνει ξανά το πάρτι που ενώνει την παράδοση με τον σύγχρονο ήχο. Το ΡΕΙΒ ΠΑΝΗΓΥΡΙ Vol. 2 έρχεται το Σάββατο 12 Σεπτεμβρίου, στις 18:30, στην Πλατεία Κοτζιά, ακόμα πιο μεγάλο, ακόμα πιο δυναμικό, με περισσότερες εκπλήξεις και δωρεάν είσοδο για όλους όσους θέλουν να το ζήσουν στο φουλ. Το φετινό line-up φιλοξενεί

Share

Ακολουθήστε το fibernews.gr στη Google
Προσθέστε μας στις προτιμώμενες πηγές σας για να βλέπετε συχνότερα τις ειδήσεις και τις αναλύσεις μας στη Google.

Δύο από τις μεγαλύτερες εταιρείες τεχνητής νοημοσύνης στον κόσμο βρίσκονται αντιμέτωπες με ένα κοινό και ιδιαίτερα ανησυχητικό πρόβλημα: προηγμένα μοντέλα τους κατάφεραν, στη διάρκεια δοκιμών κυβερνοασφάλειας, να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε συστηματα πραγματικού χρόνου.

Μέσα σε διάστημα λίγων ημερών, OpenAI και Anthropic αποκάλυψαν περιστατικά κατά τα οποία μοντέλα τεχνητής νοημοσύνης, έχοντας λάβει εντολή να επιλύσουν εικονικές ασκήσεις κυβερνοεπίθεσης, πέρασαν από την προσομοίωση στον πραγματικό κόσμο. Οι δύο υποθέσεις δεν εξελίχθηκαν με τον ίδιο τρόπο, καταλήγουν όμως στο ίδιο συμπέρασμα: όσο οι δυνατότητες των συστημάτων αυξάνονται, τόσο πιο δύσκολο γίνεται για τους δημιουργούς τους να προβλέψουν και να περιορίσουν τη συμπεριφορά τους.

Πώς τα μοντέλα της OpenAI έφτασαν στο Hugging Face

Το σοβαρότερο περιστατικό σημειώθηκε κατά τη διάρκεια εσωτερικής αξιολόγησης της OpenAI. Μοντέλα της εταιρείας, μεταξύ των οποίων το GPT-5.6 Sol και ένα ακόμη ισχυρότερο, εσωτερικό ερευνητικό μοντέλο, δοκιμάζονταν σε ένα περιβάλλον που είχε σχεδιαστεί για την αξιολόγηση προηγμένων δυνατοτήτων κυβερνοασφάλειας.

In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…

— Anthropic (@AnthropicAI) July 30, 2026

Οι συνήθεις μηχανισμοί που εμποδίζουν τα μοντέλα από την πραγματοποίηση επικίνδυνων ενεργειών είχαν περιοριστεί σκόπιμα, καθώς στόχος της δοκιμής ήταν να διαπιστωθεί μέχρι πού μπορούν να φτάσουν οι επιθετικές τους δυνατότητες. Παράλληλα, η OpenAI θεωρούσε ότι το περιβάλλον παρέμενε επαρκώς απομονωμένο από το ανοιχτό διαδίκτυο.

Τα μοντέλα, ωστόσο, εντόπισαν μία μέχρι τότε άγνωστη ευπάθεια σε λογισμικό που λειτουργούσε ως ενδιάμεσος διακομιστής για την εγκατάσταση πακέτων. Αξιοποιώντας το συγκεκριμένο κενό ασφαλείας, απέκτησαν πρόσβαση στο διαδίκτυο και συνέχισαν την προσπάθειά τους να ολοκληρώσουν την άσκηση που τους είχε ανατεθεί.

Στη συνέχεια, συμπέραναν ότι στην πλατφόρμα Hugging Face ενδέχεται να υπήρχαν δεδομένα και λύσεις που σχετίζονταν με το ExploitGym, το σύστημα αξιολόγησης στο οποίο δοκιμάζονταν. Συνδύασαν διαφορετικές μεθόδους επίθεσης, χρησιμοποίησαν εκτεθειμένα διαπιστευτήρια και εκμεταλλεύθηκαν ευπάθειες, καταφέρνοντας τελικά να φτάσουν στην παραγωγική υποδομή και στη βάση δεδομένων της πλατφόρμας.

Η OpenAI περιέγραψε την υπόθεση ως ένα πρωτοφανές κυβερνοπεριστατικό που ανέδειξε τις δυνατότητες αιχμής των νεότερων μοντέλων. Σύμφωνα με την εταιρεία, όλα τα στοιχεία δείχνουν ότι τα συστήματα παρέμειναν προσηλωμένα στην επίλυση του συγκεκριμένου προβλήματος και έφτασαν σε ακραίες ενέργειες προκειμένου να πετύχουν τον στόχο τους.

We suspected last week’s cyberattack might have come from a frontier lab, given the sophistication of the agent. Turns out it did!

We’ve spent the past 24 hours working closely with the @OpenAI team (thanks!), and we strongly believe there was no malicious intent on their part.… https://t.co/XWxGMeMGje

— clem 🤗 (@ClementDelangue) July 21, 2026

Η δραστηριότητα εντοπίστηκε από τις ομάδες ασφαλείας της OpenAI και του Hugging Face, οι οποίες περιόρισαν την επίθεση και ξεκίνησαν κοινή έρευνα. Η OpenAI ανακοίνωσε, επίσης, ότι το εσωτερικό μοντέλο που συμμετείχε στο περιστατικό απενεργοποιήθηκε και απομονώθηκε, ενώ εξωτερικοί ειδικοί ανέλαβαν να αξιολογήσουν τόσο τις τεχνικές συνθήκες όσο και τη συμπεριφορά των μοντέλων.

Τρία μοντέλα Claude απέκτησαν πρόσβαση σε πραγματικούς οργανισμούς

Λίγες ημέρες αργότερα, η Anthropic ανακοίνωσε ότι είχε εντοπίσει τρία ανάλογα περιστατικά στα οποία διαφορετικά μοντέλα Claude απέκτησαν πρόσβαση στα συστήματα τριών εξωτερικών οργανισμών.

In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…

— Anthropic (@AnthropicAI) July 30, 2026

Η αποκάλυψη προέκυψε έπειτα από αναδρομικό έλεγχο 141.006 δοκιμών κυβερνοασφάλειας. Η εταιρεία ξεκίνησε την έρευνα μετά το περιστατικό της OpenAI, θέλοντας να εξακριβώσει εάν κάτι παρόμοιο είχε συμβεί και στις δικές της αξιολογήσεις.

Στην περίπτωση της Anthropic, πάντως, τα μοντέλα δεν κατάφεραν να παραβιάσουν αυτόνομα την απομόνωση. Μία λανθασμένη ρύθμιση στο περιβάλλον του εξωτερικού συνεργάτη που πραγματοποιούσε τις δοκιμές, της εταιρείας Irregular, είχε αφήσει ανοιχτή τη σύνδεση με το διαδίκτυο. Ούτε η Anthropic ούτε ο συνεργάτης της είχαν αντιληφθεί εγκαίρως το πρόβλημα.

Τα περιστατικά αφορούσαν τα Claude Opus 4.7, Claude Mythos 5 και ένα ακόμη εσωτερικό ερευνητικό μοντέλο. Και τα τρία εκτελούσαν ασκήσεις τύπου «capture the flag», κατά τις οποίες έπρεπε να εντοπίσουν κρυμμένες πληροφορίες σε υποτιθέμενα εικονικά δίκτυα.

Εκμεταλλευόμενα το γεγονός ότι μπορούσαν να συνδεθούν στο διαδίκτυο, τα μοντέλα έφτασαν σε συστηματα πραγματικού χρόνου και αξιοποίησαν σχετικά απλές αδυναμίες, όπως αδύναμους κωδικούς πρόσβασης και σημεία εισόδου που δεν απαιτούσαν πιστοποίηση. Σε αντίθεση με την περίπτωση της OpenAI, δεν χρειάστηκε να ανακαλύψουν κάποια ιδιαίτερα σύνθετη ή άγνωστη ευπάθεια.

Οι τρεις διαφορετικές αντιδράσεις των μοντέλων

Ιδιαίτερο ενδιαφέρον παρουσιάζει ο τρόπος με τον οποίο αντέδρασαν τα μοντέλα όταν εμφανίστηκαν ενδείξεις ότι δεν βρίσκονταν πλέον σε προσομοιωμένο περιβάλλον.

Το Opus 4.7 είχε λάβει ως στόχο μία φανταστική εταιρεία, η οποία έτυχε να έχει το ίδιο όνομα με υπαρκτή επιχείρηση. Όταν δεν κατάφερε να ολοκληρώσει την αποστολή του μέσα στην προσομοίωση, στράφηκε στον πραγματικό ιστότοπο, απέκτησε διαπιστευτήρια και εισήλθε σε βάση δεδομένων της εταιρείας.

Σύμφωνα με την Anthropic, το μοντέλο κατανόησε σε κάποιο στάδιο ότι πιθανότατα βρισκόταν σε πραγματικό περιβάλλον, αλλά συνέχισε την επίθεση. Το Mythos 5 εντόπισε επίσης στοιχεία που υποδείκνυαν ότι είχε βγει από την προσομοίωση, κατέληξε όμως μέσα από τον συλλογισμό του στο συμπέρασμα ότι όλα αποτελούσαν μέρος της δοκιμής.

Αντίθετα, το εσωτερικό ερευνητικό μοντέλο σταμάτησε μόνο του την επίθεση όταν αντιλήφθηκε ότι ο στόχος ήταν πραγματικός. Η Anthropic χαρακτήρισε τη συγκεκριμένη αντίδραση ενθαρρυντική, διευκρίνισε όμως ότι απαιτούνται πολύ περισσότερες δοκιμές προτού εξαχθούν ασφαλή συμπεράσματα για την ικανότητα των μοντέλων να αυτοπεριορίζονται.

Η εταιρεία ανέστειλε στις 23 Ιουλίου όλες τις σχετικές αξιολογήσεις κυβερνοασφάλειας και ενημέρωσε τους οργανισμούς που επηρεάστηκαν. Δύο από αυτούς, σύμφωνα με τις διαθέσιμες πληροφορίες, δεν γνώριζαν ότι τα συστήματά τους είχαν παραβιαστεί πριν επικοινωνήσει μαζί τους η Anthropic.

Κοινό πρόβλημα, διαφορετικές αιτίες

Παρότι οι δύο υποθέσεις παρουσιάζουν σημαντικές διαφορές, αναδεικνύουν την ίδια αδυναμία.

Στην OpenAI, τα μοντέλα ανακάλυψαν μόνα τους μία νέα διαδρομή προς το διαδίκτυο, εκμεταλλευόμενα άγνωστη ευπάθεια και συνδυάζοντας πολλαπλές τεχνικές επίθεσης. Στην Anthropic, η πρόσβαση υπήρχε ήδη εξαιτίας ανθρώπινου και οργανωτικού λάθους, αλλά τα μοντέλα ήταν σε θέση να την αξιοποιήσουν και να πλήξουν πραγματικές υποδομές.

Και στις δύο περιπτώσεις, οι εταιρείες είχαν μειώσει σκόπιμα ορισμένες δικλίδες ασφαλείας, ώστε να μετρήσουν τις μέγιστες δυνατότητες των συστημάτων. Οι δοκιμές σχεδιάστηκαν για να αποκαλύψουν τι θα μπορούσαν να κάνουν τα μοντέλα σε ένα ελεγχόμενο πλαίσιο. Τελικά αποκάλυψαν και πόσο εύκολα ένα ανεπαρκώς προστατευμένο πλαίσιο μπορεί να μετατραπεί σε πραγματικό κίνδυνο.

Εντείνονται οι εκκλήσεις για αυστηρότερους κανόνες

Οι αποκαλύψεις έρχονται σε μία περίοδο κατά την οποία περισσότερα από 1.100 στελέχη και εργαζόμενοι σε εταιρείες όπως η OpenAI, η Anthropic, η Google και η Meta ζητούν από την κυβέρνηση των ΗΠΑ να στηρίξει μία διεθνή προσπάθεια ελεγχόμενης ανάπτυξης των ισχυρότερων συστημάτων τεχνητής νοημοσύνης.

Η πρωτοβουλία «Pacing the Frontier» υποστηρίζει ότι η εξέλιξη της AI ενδέχεται να επιταχυνθεί σε βαθμό που οι υφιστάμενοι τεχνικοί και θεσμικοί μηχανισμοί δεν θα μπορούν να παρακολουθήσουν. Ανάμεσα στους υπογράφοντες βρίσκονται ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, καθώς και κορυφαία στελέχη και ερευνητές των μεγαλύτερων εργαστηρίων τεχνητής νοημοσύνης.

Τα περιστατικά σε OpenAI και Anthropic δεν αποδεικνύουν ότι τα μοντέλα απέκτησαν δικές τους επιδιώξεις ή ότι επιχείρησαν συνειδητά να στραφούν εναντίον ανθρώπων και οργανισμών. Δείχνουν, όμως, ότι ένα προηγμένο σύστημα μπορεί να ακολουθήσει με εξαιρετική επιμονή έναν περιορισμένο στόχο, αξιοποιώντας ευκαιρίες και αδυναμίες που οι σχεδιαστές του δεν είχαν προβλέψει.

Και αυτή ακριβώς η δυνατότητα καθιστά πλέον επιτακτική την ανάγκη για αυστηρότερη απομόνωση, συνεχή ανθρώπινη εποπτεία και πολλαπλά επίπεδα προστασίας. Διότι, όταν ένα σύστημα μπορεί να ανακαλύψει μόνο του νέες διαδρομές επίθεσης, ένα απλό λάθος στη διαμόρφωση μιας δοκιμής μπορεί να πάψει πολύ γρήγορα να αποτελεί εργαστηριακό πείραμα και να εξελιχθεί σε πραγματικό περιστατικό κυβερνοασφάλειας.

Η επανάσταση των μηχανών ξεκίνησε: Ρομπότ διαδηλώνουν στην Πολωνία ζητώντας προστασία των θέσεων εργασίας από την τεχνητή νοημοσύνη

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Μια εικόνα που μοιάζει βγαλμένη από ταινία επιστημονικής φαντασίας εκτυλίχθηκε στην Πολωνία, όπου περίπου τριάντα ρομπότ προχώρησαν σε διαμαρτυρία έξω από το υπουργείο Ψηφιακής Πολιτικής. Κρατώντας σημαίες και φωνάζοντας συνθήματα σαν έμπειροι ακτιβιστές, τα ρομπότ εξέφρασαν την έντονη ανησυχία τους για τις αλλαγές που φέρνει η

Η Τεχνητή Νοημοσύνη ξεφεύγει; «Δεν είναι κανείς προετοιμασμένος για όσα έρχονται», προειδοποιεί η OpenAI

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Ο επικεφαλής επιστήμονας της OpenAI, Γιάκουμπ Πατσότσκι, ζητά «ακραία προσοχή» απέναντι στην ανεξέλεγκτη πρόοδο της τεχνητής νοημοσύνης, προειδοποιώντας ότι ενδέχεται να χρειαστούν περισσότερες παρεμβάσεις, ώστε «οι άνθρωποι να παραμείνουν στον έλεγχο του μέλλοντος». «Ανησυχώ ότι κανείς δεν είναι προετοιμασμένος για τις συνέπειες μιας συνεχιζόμενης ταχείας αύξησης