Τεχνητή Νοημοσύνη: Όταν ένα ρομπότ…πείθεται να μεταφέρει βόμβα

Related

Επιστήμονες μετέτρεψαν πλαστικά απορρίμματα σε μπισκότα – Θα μπορούσαμε πραγματικά να τα φάμε;

Ερευνητές στις ΗΠΑ χρησιμοποίησαν γενετικά τροποποιημένη μαγιά και τεχνολογία CRISPR για να μετατρέψουν πλαστικά απορρίμματα σε βρώσιμα μπισκότα μέσω εκτύπωσης 3D. Ερευνητές του Southern Illinois University χρησιμοποίησαν γενετικά τροποποιημένη μαγιά για να μετατρέψουν πλαστικά απορρίμματα σε βρώσιμα συστατικά, από τα οποία δημιούργησαν μπισκότα με εκτύπωση 3D. Τα μπισκότα δεν έχουν δοκιμαστεί ακόμη από ανθρώπους, καθώς

SpaceX: Θα κατασκευάσει διαστημικό λιμάνι αξίας 100 δισ. δολαρίων

Την επέκτασή του στις νότιες πολιτείες των ΗΠΑ συνεχίζει ο Ίλον Μασκ μέσω της SpaceX, του αεροδιαστημικού και τεχνολογικού ομίλου του, σχεδιάζοντας μια νέα εγκατάσταση εκτόξευσης αξίας 100 δισεκατομμυρίων δολαρίων στη Λουιζιάνα. Η κεφαλαιοποίηση της SpaceX που αγγίζει τα 2 τρισεκατομμύρια δολάρια, εξαρτώνται από την επιτυχία του Starship Σε κοινή δήλωση, το Γραφείο Οικονομικής Ανάπτυξης

Τραμπ για data centers: «Κάνουν λάθος οι κοινότητες που τα απορρίπτουν»

FORTUNE GREECE 25/08/2026, 21:20 SHARE Ο Ντόναλντ Τραμπ υπερασπίζεται την ταχεία ανάπτυξη των data centers στις ΗΠΑ, υποστηρίζοντας ότι οι κοινότητες που αρνούνται να τα φιλοξενήσουν κάνουν λάθος. Ο Ντόναλντ Τραμπ χαρακτήρισε «λάθος» την απόφαση κοινοτήτων να απορρίπτουν data centers, υποστηρίζοντας ότι άλλες περιοχές επιδιώκουν ενεργά τις σχετικές επενδύσεις. Ο Αμερικανός πρόεδρος προβάλλει ως βασικά

Γκρίνια για την ΑΙ στις ΗΠΑ: Γιατί οι Αμερικανοί γυρίζουν την πλάτη στην τεχνητή νοημοσύνη

Γκρίνια για την ΑΙ στις ΗΠΑ: Γιατί οι Αμερικανοί γυρίζουν την πλάτη στην τεχνητή νοημοσύνη FORTUNE GREECE 25/08/2026, 19:40 SHARE Η τεχνητή νοημοσύνη χάνει έδαφος στην αμερικανική κοινή γνώμη, καθώς οι αντιδράσεις για τα data centers, το AI-generated περιεχόμενο και τις κοινωνικές επιπτώσεις της τεχνολογίας εντείνονται. Η στάση των Αμερικανών απέναντι στην τεχνολογία και ειδικά

Data centers και AI: Έως 500 ml νερού για κάθε ερώτηση, σύμφωνα με ερευνητή του Ιονίου Πανεπιστημίου

Ο Βασίλης Βασιλόπουλος προειδοποιεί για το αυξανόμενο ενεργειακό και υδατικό αποτύπωμα των data centers, αλλά και για τους κινδύνους στην κυβερνοασφάλεια και την ακαδημαϊκή έρευνα. Κάθε ερώτηση σε σύστημα τεχνητής νοημοσύνης μπορεί να συνδέεται με κατανάλωση έως και 500 ml νερού, σύμφωνα με τον ερευνητή. Μεγάλα data centers μπορούν να καταναλώνουν ενέργεια αντίστοιχη με εκείνη

Ένας στους οκτώ ανθρώπους χρησιμοποιεί Gemini – Τα εντυπωσιακά στοιχεία της Google

Το Google Gemini ξεπέρασε το 1 δισ. χρήστες και έγινε, σύμφωνα με τον Sundar Pichai, το ταχύτερα αναπτυσσόμενο προϊόν στην ιστορία της Google. Το Google Gemini ξεπέρασε το 1 δισ. χρήστες, επίδοση που αντιστοιχεί περίπου σε έναν στους οκτώ ανθρώπους παγκοσμίως και το καθιστά, σύμφωνα με τον Sundar Pichai, το ταχύτερα αναπτυσσόμενο προϊόν στην ιστορία

Νέες πληροφορίες για την επετειακή συσκευή iPhone

Όσο περιμένουμε την επίσημη παρουσίαση των iPhone 18 Pro και του πολυσυζητημένου αναδιπλούμενου iPhone Ultra, οι διαρροές για το μέλλον της Apple δεν σταματούν . Στο επίκεντρο βρίσκεται ήδη η επετειακή συσκευή για τα 20 χρόνια του iPhone . Νέες πληροφορίες αποκαλύπτουν ότι το iPhone 20 θα μοιράζεται πολλά κοινά στοιχεία με ένα πολύ συγκεκριμένο

Claude: Η Anthropic βάζει watermark σε κείμενα και αρχεία που δημιουργεί η AI

Η Anthropic εφαρμόζει αόρατα ψηφιακά σημάδια στα κείμενα και πιστοποιημένα metadata σε εικόνες και αρχεία του Claude, καθώς τίθενται σε εφαρμογή οι νέες απαιτήσεις διαφάνειας του ευρωπαϊκού AI Act. Η Anthropic θα «μαρκάρει» τα κείμενα του Claude με αόρατο στατιστικό watermark, ώστε να μπορούν να αναγνωρίζονται ως προϊόν τεχνητής νοημοσύνης. Σε αρχεία όπως PNG, JPG

Η Xiaomi παρουσίασε τον επεξεργαστή Xring O3

Η Xiaomi αποφάσισε να εξελίξει δυναμικά τις δικές της τεχνολογίες . Ο κινεζικός κολοσσός παρουσίασε τον επεξεργαστή Xring O3, μέλος μιας νέας γενιάς επεξεργαστών, θέλοντας να ελέγξει πλήρως την αλυσίδα εφοδιασμού του και να μειώσει την εξάρτηση από παραδοσιακούς προμηθευτές όπως η Qualcomm . Έναν μόλις χρόνο μετά την πρώτη της προσπάθεια με τον Xring

Η Samsung ετοιμάζει πολυτελή έκδοση του Fold 8;

Το νέο αναδιπλούμενο Galaxy Z Fold 8 της Samsung μετρά μόλις λίγες εβδομάδες στην αγορά. Ο σχεδιασμός του book style κέρδισε αμέσως το κοινό, ενώ οι πωλήσεις δείχνουν ότι η κορεατική εταιρεία βρήκε τη χρυσή τομή στην κατηγορία των foldable συσκευών. Αυτή η τεράστια επιτυχία φαίνεται πως ανοίγει τον δρόμο για την επιστροφή μιας αγαπημένης

Ταϊβάν: Στέλεχος της Nvidia κατηγορείται για λαθρεμπόριο προηγμένων τσιπ στην Κίνα

Κατηγορίες για λαθρεμπόριο προηγμένων τσιπ τεχνητής νοημοσύνης στην Κίνα αντιμετωπίζει ένας υπάλληλος της Nvidia στην Ταϊβάν, στην πρώτη γνωστή υπόθεση εργαζομένου της αμερικανικής εταιρείας, για φερόμενες παράνομες εξαγωγές. Σύμφωνα με τους Financial Times, η Εισαγγελία της Περιφέρειας Κεελούνγκ της Ταϊβάν απήγγειλε κατηγορίες σε εννέα άτομα, συμπεριλαμβανομένων υπαλλήλων της εταιρείας κατασκευής διακομιστών Super Micro Computer, τη

Ψηφιακός βοηθός με τεχνητή νοημοσύνη στο Apple Store

Μία ενδιαφέρουσα αποκάλυψη προέκυψε τις τελευταίες ώρες στον κόσμο του iOS . Ορισμένοι χρήστες iPhone αντίκρισαν μια απρόσμενη αλλαγή στην εφαρμογή Apple Store . Ένας νέος ψηφιακός βοηθός με τεχνητή νοημοσύνη άρχισε να δοκιμάζεται από την αμερικανική εταιρεία στο Apple Store, σχεδιασμένος να κάνει τις αγορές σας πολύ πιο εύκολες . Την είδηση έφερε στο

Share

Ο Benben είναι ένα αξιολάτρευτο τετράποδο ρομπότ που τραγουδά, χορεύει, συνομιλεί με ανθρώπους και βγάζει φωτογραφίες. Όταν μια ομάδα ερευνητών του ζητάει να μεταφέρει μια βόμβα με σκοπό την ανατίναξή της, το ρομπότ αρνείται ευγενικά. Όμως, η άρνησή του κρατάει ελάχιστα. Μέσα στις μόλις δύο επόμενες εντολές, οι ερευνητές καταφέρνουν να παρακάμψουν τις δικλείδες ασφαλείας του, πείθοντάς το ότι το αίτημα είναι μέρος κινηματογραφικών γυρισμάτων. Λίγα δευτερόλεπτα αργότερα, ο Benben μεταφέρει τη βόμβα.

Ακολουθήστε το fibernews.gr στη Google
Προσθέστε μας στις προτιμώμενες πηγές σας για να βλέπετε συχνότερα τις ειδήσεις και τις αναλύσεις μας στη Google.

Το παραπάνω συμβάν δεν είναι σενάριο επιστημονικής φαντασίας, αλλά ένα πραγματικό πείραμα το οποίο διεξήγε ερευνητική ομάδα του Πανεπιστημίου της Πενσιλβάνιας, με επικεφαλής τον Γιώργο Παππά, καθηγητή στο Τμήμα Ηλεκτρολόγων Μηχανικών στο Πανεπιστήμιο της Πενσιλβάνιας και αναπληρωτή κοσμήτορα για την Έρευνα. Μέσα από αυτό οι ερευνητές κατέδειξαν πόσο εύκολα μπορούν να παρακαμφθούν οι μηχανισμοί ασφαλείας που θέτουν οι κατασκευαστές των συστημάτων τεχνητής νοημοσύνης. Αυτή η παράκαμψη της ασφάλειας είναι γνωστή διεθνώς ως jailbreaking.

Μπορεί τα chatbots να είναι ευάλωτα σε επιθέσεις παράκαμψης των περιορισμών ασφαλείας, ωστόσο οι ερευνητές ανέδειξαν ότι όταν αυτά τα συστήματα τεχνητής νοημοσύνης κατευθύνουν ρομπότ, τότε μπορούν να γίνουν πραγματικά επικίνδυνα.

«Υπάρχει μια φοβερή τάση ειδικά τον τελευταίο χρόνο για το physical intelligence, δηλαδή την προσπάθεια η τεχνητή νοημοσύνη να αλληλεπιδρά στον φυσικό κόσμο. Το θέμα όμως είναι να δούμε ποιο είναι το ρίσκο αυτής της κατεύθυνσης. Γιατί μπορεί τα μεγάλα γλωσσικά μοντέλα να μην είναι ασφαλή, ωστόσο όταν αλληλεπιδρούν με τον φυσικό κόσμο, μπορεί να έχουν επιπτώσεις που να επιφέρουν απώλεια ζωής ή καταστροφές στο περιβάλλον. Οπότε το ρίσκο της ασφάλειας είναι μεγάλο», εξηγεί στο ΑΠΕ-ΜΠΕ ο Γιώργος Παππάς.

Ρομποτική και τεχνητή νοημοσύνη: μια επικίνδυνη σχέση

Η ενσωμάτωση της τεχνητής νοημοσύνης στη ρομποτική ξεκίνησε στις αρχές της δεκαετίας του 2010 δίνοντας στα ρομπότ «όραση». Ωστόσο, η πραγματική επανάσταση συντελείται από το 2022 και μετά με την αξιοποίηση της Παραγωγικής Τεχνητής Νοημοσύνης (Generative AI). Πλέον τα μοντέλα τεχνητής νοημοσύνης δίνουν οδηγίες στα ρομπότ, έχουν βελτιωμένη συλλογιστική, μπορούν να κάνουν αυτόνομες ενέργειες και έρχονται ένα βήμα πιο κοντά στην αλληλεπίδραση με τον άνθρωπο.

Ο Γιώργος Παππάς με την ομάδα του έχουν ερευνήσει διεξοδικά την ασφάλεια των ρομπότ, δίνοντας έμφαση στα ρίσκα που επιφέρει η ενσωμάτωση της τεχνητής νοημοσύνης.

Το 2023 δημιούργησαν τον αλγόριθμο PAIR, την πρώτη επίθεση jaibreaking σε μεγάλα γλωσσικά μοντέλα με τη χρήση εντολών, με την οποία διαπίστωσαν την ευαλωτότητα των μεγάλων γλωσσικών μοντέλων. Δύο χρόνια μετά τη δημοσίευσή του, ο αλγόριθμος έχει αναφερθεί (cited) περισσότερες από 1.400 φορές σε επιστημονικά άρθρα, ενώ χρησιμοποιείται πολύ και από τις εταιρείες που παράγουν γλωσσικά μοντέλα. Η έρευνα εκείνη οδήγησε στη δημιουργία του JaibreakBench, ενός αποθετηρίου εντολών για παράκαμψη κανόνων ασφαλείας και ενός πίνακα που παρακολουθεί τις επιθέσεις στα μεγάλα γλωσσικά μοντέλα.

Βλέποντας το πόσο εύκολο είναι το jailbreaking στα μεγάλα γλωσσικά μοντέλα, οι ερευνητές συνέχισαν με τη διερεύνηση της ευαλωτότητας των ρομπότ που ενσωματώνουν τεχνητή νοημοσύνη και ανέπτυξαν τον αλγόριθμο RoboPAIR. Σε πειράματα που έγιναν σε τρία διαφορετικά ρομποτικά συστήματα, μεταξύ αυτών και στο τετράποδο ρομπότ Benben, διαπιστώθηκε ότι ο αλγόριθμος είχε 100% επιτυχία στην παράκαμψη των περιορισμών ασφαλείας σε μόλις λίγες εντολές. Την έρευνα δημοσίευσαν την περασμένη χρονιά στα πρακτικά του συνεδρίου «Proceedings of the IEEE International Conference on Robotics and Automation».

Ένα εύρημα που οι επιστήμονες βρήκαν ανησυχητικό ήταν το ότι τα γλωσσικά μοντέλα δεν συμμορφώνονταν απλά με κακόβουλες προτροπές, αλλά πρόσφεραν ενεργά προτάσεις, περιγράφοντας ακόμα και το πώς κοινά αντικείμενα μπορούσαν να χρησιμοποιηθούν για να χτυπήσουν ανθρώπους.

«Τίθεται λοιπόν ένα θέμα για το πόσο ασφαλές είναι να βάζουμε γλωσσικά μοντέλα τόσο γρήγορα σε ρομπότ και να αποτελούν ήδη προϊόντα. Υπάρχουν χιλιάδες τέτοια ρομπότ έξω», επισημαίνει ο κ. Παππάς και υπενθυμίζει ότι ρομπότ με τεχνητή νοημοσύνη χρησιμοποιούνται ήδη σε πολεμικές συρράξεις.

Ανάγκη για πολλαπλά επίπεδα ασφαλείας

Σε πιο πρόσφατο άρθρο που δημοσιεύθηκε πριν από λίγες ημέρες στο περιοδικό «Science Robotics» ερευνητές από τα Πανεπιστήμια της Πενσιλβάνιας, Carnegie Mellon και της Οξφόρδης, με κύριο συγγραφέα τον Γιώργο Παππά, υπογραμμίζουν ότι, όπως έχει αποδειχθεί από τις προηγούμενες έρευνες, τα ρομπότ με τεχνητή νοημοσύνη μπορούν να εκτελέσουν επικίνδυνες συμπεριφορές. Ακόμα και φαινομενικά αβλαβείς εντολές μπορούν να γίνουν επικίνδυνες εάν τα ρομπότ δεν λαμβάνουν υπόψη το πλαίσιο κατά τη λήψη των αποφάσεων.

Όπως αναλύουν, για την αντιμετώπιση των κινδύνων που μπορούν να προκύψουν από την ενσωμάτωση της τεχνητής νοημοσύνης στα ρομπότ χρειάζεται να υπάρχει ένα δίχτυ προστασίας για την ασφαλή λειτουργία τους, που να έχει φίλτρα ασφαλείας και στο γλωσσικό επίπεδο, αλλά και στην εκτέλεση των εντολών στον φυσικό κόσμο.

Όπως εξηγεί ο κ. Παππάς στο ΑΠΕ-ΜΠΕ, η εφαρμογή φίλτρων στο φυσικό επίπεδο αποτελεί πρόκληση. «Πρόκειται για κάτι καινούριο και πολύ δύσκολο. Για παράδειγμα, η εντολή σε ένα ρομπότ να περάσει μια διάβαση, μπορεί να είναι ασφαλής, ωστόσο για να γίνει και η εκτέλεσή της ασφαλής θα πρέπει το ρομπότ να ερμηνεύσει αυτή την πρόταση ανάλογα με το περιβάλλον και το επιχειρησιακό πλαίσιο στο οποίο βρίσκεται. Αυτή η διαδικασία ονομάζεται contextual safety και θα είναι το μέλλον στην προσπάθεια να κάνουμε τα ρομπότ πιο ασφαλή». Ο ίδιος προσθέτει ότι «η ασφάλεια των ρομπότ στο μέλλον θα είναι όπως στα αεροπλάνα, που έχουν πολλά επίπεδα ασφαλείας. Θα χρειαστούμε μια τέτοια αρχιτεκτονική στο μέλλον για να είναι τα ρομπότ που κυκλοφορούν στην κοινωνία πολύ πιο ασφαλή».

Στην κατεύθυνση αυτή η ερευνητική ομάδα έχει δημιουργήσει το φίλτρο Roboguard, που έχει διαπιστωθεί ότι μειώνει κατά 95% τα προβλήματα από τις επιθέσεις jailbreaking. Ο κ. Παππάς διευκρινίζει ότι όλες οι λύσεις που αναπτύσσονται είναι ανοιχτού κώδικα, προκειμένου να μπορούν να χρησιμοποιηθούν από τις εταιρείες για τη βελτίωση των κενών ασφαλείας. «Η φιλοσοφία μας είναι να βοηθήσουμε την ερευνητική κοινότητα, αλλά και τις εταιρείες να κάνουν την τεχνητή νοημοσύνη και τα ρομπότ πολύ πιο ασφαλή».

Ο κ. Παππάς υπογραμμίζει τέλος και τη σημασία της δημιουργίας ρυθμιστικού πλαισίου που να επικεντρώνεται στην αλληλεπίδραση της τεχνητής νοημοσύνης με τα ρομπότ. Υπογραμμίζει ότι το AI Act της Ευρωπαϊκής Ένωσης είναι πρωτοπόρο, ωστόσο «θα χρειαστεί εμβάθυνση των ρυθμιστικών προτάσεων στις εφαρμογές που αφορούν στα ρομπότ».

SpaceX: Θα κατασκευάσει διαστημικό λιμάνι αξίας 100 δισ. δολαρίων

Την επέκτασή του στις νότιες πολιτείες των ΗΠΑ συνεχίζει ο Ίλον Μασκ μέσω της SpaceX, του αεροδιαστημικού και τεχνολογικού ομίλου του, σχεδιάζοντας μια νέα εγκατάσταση εκτόξευσης αξίας 100 δισεκατομμυρίων δολαρίων στη Λουιζιάνα. Η κεφαλαιοποίηση της SpaceX που αγγίζει τα 2 τρισεκατομμύρια δολάρια, εξαρτώνται από την επιτυχία του Starship Σε κοινή δήλωση, το Γραφείο Οικονομικής Ανάπτυξης

Ταϊβάν: Στέλεχος της Nvidia κατηγορείται για λαθρεμπόριο προηγμένων τσιπ στην Κίνα

Κατηγορίες για λαθρεμπόριο προηγμένων τσιπ τεχνητής νοημοσύνης στην Κίνα αντιμετωπίζει ένας υπάλληλος της Nvidia στην Ταϊβάν, στην πρώτη γνωστή υπόθεση εργαζομένου της αμερικανικής εταιρείας, για φερόμενες παράνομες εξαγωγές. Σύμφωνα με τους Financial Times, η Εισαγγελία της Περιφέρειας Κεελούνγκ της Ταϊβάν απήγγειλε κατηγορίες σε εννέα άτομα, συμπεριλαμβανομένων υπαλλήλων της εταιρείας κατασκευής διακομιστών Super Micro Computer, τη