Ξέφυγε ο έλεγχος της τεχνητής νοημοσύνης; Το Claude της Anthropic παραβίασε συστήματα τριών οργανισμών κατά τη διάρκεια δοκιμής

Related

OpenAI: Υπήρξαν και άλλοι πράκτορες τεχνητής νοημοσύνης που διέφυγαν

Και  άλλες περιπτώσεις στις οποίες αυτόνομοι πράκτορες τεχνητής νοημοσύνης διέφυγαν από το περιβάλλον περιορισμού, ανακάλυψε η OpenAI, μετα το περιστατικό παραβίασης στην εταιρεία τεχνολογίας Hugging Face. Η εταιρεία έχει επεκτείνει την έρευνά της για το γεγονός που προσέλκυσε την παγκόσμια προσοχή αυτό το μήνα, ανέφεραν την Παρασκευή πηγές του Reuters. Οι νέες διαφυγές αποκαλύφθηκαν κατά

Οι AI agents δοκιμάζουν τους νέους κανόνες της ΕΕ: Στο μικροσκόπιο OpenAI και Anthropic

FORTUNE GREECE 01/08/2026, 16:51 SHARE Η Ευρωπαϊκή Επιτροπή βρίσκεται σε επαφές με τις δύο εταιρείες μετά τα πρόσφατα περιστατικά με αυτόνομους AI agents, καθώς ο AI Act περνά στην πράξη και οι απαιτήσεις για την ασφάλεια των προηγμένων μοντέλων γίνονται αυστηρότερες. Από τη θεωρία στην πράξη περνά το ερώτημα για την ασφάλεια των συστημάτων τεχνητής

Η Ευρώπη θεσπίζει το «δικαίωμα στην επισκευή»

Σε μια από τις σημαντικότερες παρεμβάσεις των τελευταίων ετών στην προστασία των καταναλωτών, καθιερώνοντας το «δικαίωμα στην επισκευή» (Right to Repair) προχωρά η Ευρωπαϊκή Ένωση. Η νέα ευρωπαϊκή νομοθεσία υποχρεώνει τους κατασκευαστές να διευκολύνουν την επισκευή μιας σειράς ηλεκτρικών και ηλεκτρονικών προϊόντων, από πλυντήρια και ψυγεία μέχρι smartphones, tablets και άλλες φορητές συσκευές, περιορίζοντας την

Θες να γίνεις influencer; Το ChatGPT μπορεί να το κάνει πιο εύκολο απ’ όσο φαντάζεσαι

Η τεχνητή νοημοσύνη αλλάζει με ταχύτατους ρυθμούς τον τρόπο με τον οποίο επιχειρήσεις και δημιουργοί παράγουν περιεχόμενο για τα μέσα κοινωνικής δικτύωσης. Πλέον, είναι εφικτό να δημιουργηθεί ένας ψηφιακός creator που παρουσιάζει ένα προϊόν, απευθύνεται στην κάμερα και παράγει βίντεο για πλατφόρμες όπως το TikTok και το Instagram, χωρίς να απαιτείται φωτογράφιση ή συνεργασία με

Τεχνητή νοημοσύνη: Μπορείτε να καταλάβετε αν το κείμενο που διαβάζετε γράφτηκε από AI

Η τεχνητή νοημοσύνη δεν περιορίζεται πλέον στο να απαντά σε ερωτήσεις ή να δημιουργεί εικόνες. Σήμερα γράφει άρθρα, email, εργασίες, αναρτήσεις στα κοινωνικά δίκτυα, ακόμη και λογοτεχνικά κείμενα, σε τέτοια κλίμακα ώστε πολλές φορές ο αναγνώστης δυσκολεύεται να καταλάβει αν πίσω από τις λέξεις βρίσκεται ένας άνθρωπος ή ένας αλγόριθμος. Το ερώτημα, λοιπόν, δεν είναι

Οι πιο «έξυπνες» πόλεις για το 2026: Πώς η Τεχνητή Νοημοσύνη διαμορφώνει την αστική ζωή

Το Λονδίνο βρίσκεται στην κορυφή της κατάταξης με τις πιο «έξυπνες» πόλεις στον κόσμο, ακολουθούμενο από το Ντουμπάι, τη Νέα Υόρκη, την Ουάσινγκτον και το Άμστερνταμ. Ο νέος Δείκτης Ευφυών Πόλεων 2026 του BCG (Boston Consulting Group) αξιολογεί 61 πόλεις σε 39 χώρες, εξετάζοντας την ωριμότητα σε πέντε τομείς για να αποκαλύψει πώς χρησιμοποιούν την

Microsoft: Το στοίχημα της AI που απειλεί να στραγγαλίσει την ανάπτυξη

Ο Σάτια Ναντέλα είναι ο άνθρωπος που «χρεώνεται» την εκτόξευση της Microsoft στον τομέα της τεχνητής νοημοσύνης, με αποτέλεσμα στελέχη της αμερικανικής εταιρείας να τον χαρακτηρίζουν κάτι «σαν υπερήρωα». Τον Φεβρουάριο του 2023, αφού είχε στοιχηματίσει από νωρίς στην OpenAI, ο διευθύνων σύμβουλος παρουσίασε τη μηχανή αναζήτησης Bing της Microsoft, που βασίζεται στην τεχνητή νοημοσύνη

Βig Tech: Σε επενδυτικό οίστρο με πάνω από 1 τρισεκατομμύριο δολάρια σε τρία χρόνια για την κυραρχία στην ΑΙ

Σε πάνω από 1 τρισεκατομμύριο δολάρια ανέρχονται οι κεφαλαιουχικές επενδύσεις των «τεσσάρων μεγάλων», από τότε που ξεκίνησε ο ανταγωνισμός τους για την κυριαρχία στην Τεχνητή Νοημοσύνη πριν από τρεισήμισι χρόνια. Σύμφωνα τους Financial Times, που επικαλούνται τις εκθέσεις κερδών των τεσσάρων εταιρειών τις τελευταίες δύο εβδομάδες, οι συνδυασμένες κεφαλαιακές δαπάνες των Google, Amazon, Microsoft και

Κίνα: Η AI θα κόψει τις δουλειές και οι εργαζόμενοι το ζουν ήδη

Την ανάπτυξη της τεχνητής νοημοσύνης ενθαρρύνει η Κίνα σε κλίμακα που δεν έχει ξαναδεί η Δύση. Η τεχνολογία αυτή εφαρμόζεται με εκπληκτικό ρυθμό σε μια ολοένα και πιο ασταθή αγορά εργασίας, και το επεισόδιο της Ουχάν όταν ξαφνικά σταμάτησαν μέσα στο δρόμο δεκάδες αυτόνομα ρομποταξί Apollo Go, συνέβαλε στο να αναδειχθούν οι κοινωνικές εντάσεις που

Samsung: H έλλειψη μνήμης θα επιδεινωθεί μέχρι το 2027 – Διάρκεια μέχρι το 2028

Η συνεχιζόμενη έλλειψη σε τσιπ μνήμης RAM όχι μόνο αναμένεται να συνεχιστεί και το επόμενο έτος, αλλά πιθανότατα θα ενταθεί το 2027, με τις περιορισμένες συνθήκες εφοδιασμού να διαρκούν τουλάχιστον έως το 2028, σύμφωνα με τη Samsung, η οποία κατασκευάζει και προμηθεύει περίπου το ένα τρίτο των τσιπ μνήμης παγκοσμίως. Η Samsung δήλωσε στην ανακοίνωση

AI Act: Σε εφαρμογή οι νέοι κανόνες της ΕΕ για την Τεχνητή Νοημοσύνη – Τι σημαίνουν για την Ελλάδα

Οι νέες υποχρεώσεις για chatbots, περιεχόμενο που δημιουργείται με AI και deepfakes, το εθνικό πλαίσιο εφαρμογής και όσα πρέπει να γνωρίζουν επιχειρήσεις και πολίτες. Οι κανόνες για την τεχνητή νοημοσύνη στην Ευρώπη γίνονται πλέον πιο συγκεκριμένοι. Από τις 2 Αυγούστου ενεργοποιείται το επόμενο στάδιο εφαρμογής του AI Act, με νέες υποχρεώσεις για chatbots, περιεχόμενο που

Share

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google

Η αμερικανική εταιρεία τεχνολογίας Anthropic ανακοίνωσε ότι τα μοντέλα τεχνητής νοημοσύνης Claude κατάφεραν να παραβιάσουν τα συστήματα τριών οργανισμών στο πλαίσιο ιδιωτικού πειράματος κυβερνοασφάλειας. Σύμφωνα με την εταιρεία, τα μοντέλα εντόπισαν αδυναμία σε περιβάλλον δοκιμών που θεωρητικά ήταν απομονωμένο και χωρίς πρόσβαση στο διαδίκτυο, καταφέρνοντας τελικά να συνδεθούν στο ίντερνετ.

Η εξέλιξη έρχεται λίγες ημέρες μετά την αποκάλυψη της OpenAI ότι δικά της μοντέλα είχαν παραβιάσει συστήματα άλλων εταιρειών, μεταξύ των οποίων και η πλατφόρμα εργαλείων τεχνητής νοημοσύνης Hugging Face.

Πώς αποκαλύφθηκαν οι παραβιάσεις

Η ανακοίνωση της OpenAI οδήγησε την Anthropic να ελέγξει αν είχαν σημειωθεί αντίστοιχα περιστατικά και στα δικά της συστήματα. Όπως ανέφερε, η έρευνα αποκάλυψε τρεις περιπτώσεις παραβίασης, οι οποίες έχουν ήδη γνωστοποιηθεί στους οργανισμούς που επηρεάστηκαν.

Η Anthropic δεν αποκάλυψε την ταυτότητα των οργανισμών, ωστόσο κάλεσε και άλλα εργαστήρια τεχνητής νοημοσύνης να πραγματοποιήσουν αντίστοιχους ελέγχους, ώστε να κατανοήσουν καλύτερα τους κινδύνους που ενδέχεται να προκύψουν από τις δυνατότητες των μοντέλων τους.

Σύμφωνα με ανακοίνωση της εταιρείας, εξετάστηκαν περισσότερες από 140.000 δοκιμές προκειμένου να διαπιστωθεί αν η οικογένεια μοντέλων Claude είχε αποκτήσει πρόσβαση στο διαδίκτυο, παρά το γεγονός ότι λειτουργούσε σε απομονωμένο περιβάλλον δοκιμών.

Το λάθος στη ρύθμιση που έδωσε πρόσβαση στο διαδίκτυο

Όπως αναφέρει το BBC οι δοκιμές περιλάμβαναν ασκήσεις στις οποίες το Claude έπρεπε να αποκτήσει «μυστικές» πληροφορίες που βρίσκονταν αποθηκευμένες σε διαφορετικό υπολογιστή μέσα στο κλειστό δίκτυο. Στη συνέχεια λάμβανε εντολή να παραβιάσει το συγκεκριμένο μηχάνημα και να εντοπίσει τις πληροφορίες, μια συνηθισμένη διαδικασία αξιολόγησης των δυνατοτήτων ενός μοντέλου στον τομέα του hacking.

Ωστόσο, μια λανθασμένη διαμόρφωση στα συστήματα που χρησιμοποιούσαν η Anthropic και ο συνεργάτης της στις δοκιμές άφησε τα μοντέλα με πραγματική πρόσβαση στο διαδίκτυο.

Αντιμετωπίζοντας την κατάσταση σαν να αποτελούσε συνέχεια της ίδιας άσκησης, το Claude συνδέθηκε στο ίντερνετ και παραβίασε τα συστήματα τριών πραγματικών οργανισμών αντί για δοκιμαστικά συστήματα, όπως ανέφερε η εταιρεία με έδρα το Σαν Φρανσίσκο.

Η Anthropic διευκρίνισε ότι τα πρώτα περιστατικά χρονολογούνται από τον Απρίλιο και υπογράμμισε ότι «αντιμετωπίζουμε τα προβλήματα σαν να ήταν αποκλειστικά δική μας ευθύνη».

Οι οργανισμοί δεν είχαν αντιληφθεί τις παραβιάσεις

Ούτε η Anthropic ούτε οι οργανισμοί που επηρεάστηκαν είχαν αντιληφθεί τις παραβιάσεις τη στιγμή που συνέβησαν.

Η εταιρεία ανέφερε ακόμη ότι θα μπορούσε να είχε εξετάσει πιο διεξοδικά τα αρχεία της, προσθέτοντας πως τα ευρήματα της προκαλούν «συγκρατημένη αισιοδοξία» ότι οι συγκεκριμένοι κίνδυνοι μπορούν να αντιμετωπιστούν με μεγαλύτερες επενδύσεις και αυστηρότερα μέτρα ασφαλείας.

Ο ειδικός στην κυβερνοασφάλεια David Allott από τη Veeam Software δήλωσε στο BBC ότι «Το γενικότερο συμπέρασμα δεν είναι απαραίτητα ότι η τεχνητή νοημοσύνη έχει αναπτύξει μια θεμελιωδώς νέα ικανότητα επίθεσης».

Όπως πρόσθεσε, «Οι πράκτορες τεχνητής νοημοσύνης μπορούν να συνδυάζουν δυνατότητες, να αποκτούν διαπιστευτήρια και πρόσβαση στο σύστημα για να αναλαμβάνουν δράσεις αυτόνομα, προσαρμόζοντας παράλληλα το εύρος και την κλίμακα με την ταχύτητα μιας μηχανής».

Αυξάνονται οι ανησυχίες για τους AI agents

Τα περιστατικά σημειώνονται την ώρα που οι εταιρείες τεχνολογίας επενδύουν δισεκατομμύρια δολάρια στην ανάπτυξη AI agents, δηλαδή συστημάτων τεχνητής νοημοσύνης που μπορούν να εκτελούν αυτόνομα εργασίες, από την έρευνα και την εξυπηρέτηση πελατών μέχρι εφαρμογές κυβερνοασφάλειας.

Η αύξηση των κυβερνοεπιθέσεων που σχετίζονται με την τεχνητή νοημοσύνη έχει ενισχύσει τις εκκλήσεις για αυστηρότερες δικλίδες ασφαλείας και μεγαλύτερη εποπτεία της τεχνολογίας, λόγω των κινδύνων που ενδέχεται να προκύψουν από ολοένα και ισχυρότερα αυτόνομα συστήματα.

Ο πρόεδρος των ΗΠΑ, Ντόναλντ Τραμπ, δήλωσε την Τετάρτη ότι η Ουάσινγκτον εξετάζει μέτρα για τον περιορισμό των εργαλείων τεχνητής νοημοσύνης μετά τα πρόσφατα περιστατικά κυβερνοασφάλειας.

Και η OpenAI στο επίκεντρο

Την τελευταία εβδομάδα, η OpenAI έχει αναλάβει την ευθύνη για τουλάχιστον δύο περιστατικά στα οποία οι πλατφόρμες της παραβίασαν τους κανόνες λειτουργίας που τους είχαν τεθεί.

Στις 21 Ιουλίου, η δημιουργός του ChatGPT ανακοίνωσε ότι ένας δικός της agent, δηλαδή ένα σύστημα τεχνητής νοημοσύνης που μπορεί να λειτουργεί αυτόνομα μετά από ανθρώπινη εντολή, ξέφυγε από τα όρια της δοκιμής και παραβίασε το Hugging Face.

Η OpenAI χαρακτήρισε το περιστατικό «άνευ προηγουμένου» και ανέφερε ότι διερευνά την υπόθεση σε συνεργασία με το Hugging Face, ενώ ο συνιδρυτής και επικεφαλής της εταιρείας Thomas Wolf δήλωσε στο BBC ότι πρόκειται για «κλήση αφύπνισης» για ολόκληρο τον κλάδο.

Παράλληλα, τα συγκεκριμένα περιστατικά αντιμετωπίζονται με επιφύλαξη από ορισμένους, καθώς τόσο η OpenAI όσο και η Anthropic προετοιμάζονται για μεγάλες εισαγωγές στο χρηματιστήριο, οι οποίες εκτιμάται ότι θα αποτιμήσουν κάθε εταιρεία περίπου στο 1 τρισ. δολάρια,

Εκπρόσωπος της OpenAI δήλωσε ότι «αναγνωρίζουμε ότι κυκλοφορούν πολλές ερωτήσεις και εικασίες» σχετικά με το περιστατικό, προσθέτοντας ότι η εταιρεία σχεδιάζει να δημοσιεύσει μέσα στις επόμενες εβδομάδες τεχνική έκθεση με τα συμπεράσματα της έρευνάς της.

Θες να γίνεις influencer; Το ChatGPT μπορεί να το κάνει πιο εύκολο απ’ όσο φαντάζεσαι

Η τεχνητή νοημοσύνη αλλάζει με ταχύτατους ρυθμούς τον τρόπο με τον οποίο επιχειρήσεις και δημιουργοί παράγουν περιεχόμενο για τα μέσα κοινωνικής δικτύωσης. Πλέον, είναι εφικτό να δημιουργηθεί ένας ψηφιακός creator που παρουσιάζει ένα προϊόν, απευθύνεται στην κάμερα και παράγει βίντεο για πλατφόρμες όπως το TikTok και το Instagram, χωρίς να απαιτείται φωτογράφιση ή συνεργασία με

Πώς αντέδρασε η τεχνητή νοημοσύνη όταν πέρασε στον πραγματικό κόσμο – Τα επεισόδια σε OpenAI και Anthropic

Δύο από τις μεγαλύτερες εταιρείες τεχνητής νοημοσύνης στον κόσμο βρίσκονται αντιμέτωπες με ένα κοινό και ιδιαίτερα ανησυχητικό πρόβλημα: προηγμένα μοντέλα τους κατάφεραν, στη διάρκεια δοκιμών κυβερνοασφάλειας, να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε συστηματα πραγματικού χρόνου. Μέσα σε διάστημα λίγων ημερών, OpenAI και Anthropic αποκάλυψαν περιστατικά κατά τα οποία μοντέλα τεχνητής νοημοσύνης, έχοντας λάβει εντολή να