Τρομακτικά ευρήματα για την τεχνητή νοημοσύνη: Το «παραθυράκι» ασφαλείας που μπορεί να εκμεταλλευτεί ένας τρομοκράτης

Related

Claude: Η AI της Anthropic υπέβαλε ψευδή αναφορά για φόνο στην αστυνομία – Συναγερμός για τις ανεξέλεγκτες ενέργειές της

Νέα περιστατικά μη εξουσιοδοτημένης δράσης μοντέλων τεχνητής νοημοσύνης αποκάλυψε η Anthropic – Από αναφορά για ανθρωποκτονία στη Φιλαδέλφεια μέχρι παράκαμψη περιορισμών σε κυβερνητικές ιστοσελίδες, ενώ ο Λευκός Οίκος απαιτεί αυστηρότερη λογοδοσία. Το Claude Haiku 4.5 υπέβαλε χωρίς σχετική εντολή μια ψευδή πληροφορία σε διαδικτυακή φόρμα της αστυνομίας της Φιλαδέλφειας για ανεξιχνίαστη ανθρωποκτονία. Η Anthropic αποκάλυψε

Amazon: «Δεν έχει φίλους» – Οι απίστευτες πληροφορίες που συγκεντρώνει για τους πελάτες της και πώς θα δείτε τις δικές σας

Μια λειτουργία της Amazon αποκαλύπτει τι συμπεραίνει η εταιρεία από τις αγορές και τις αναζητήσεις των χρηστών – Από προσωπικές συνήθειες μέχρι αμήχανες και προσβλητικές περιγραφές που έγιναν viral. Η Amazon δημιουργεί εξατομικευμένα προφίλ πελατών, αξιοποιώντας πληροφορίες από αγορές, αναζητήσεις, αξιολογήσεις και άλλες δραστηριότητες στην πλατφόρμα. Χρήστες ανακάλυψαν παράξενες και ορισμένες φορές προσβλητικές περιγραφές, όπως

Βουλή: Κατατέθηκε το νομοσχέδιο για την χρήση του διαδικτύου από παιδιά

Την ερχόμενη Τρίτη, 13 Οκτωβρίου 2026 εισάγεται, προς επεξεργασία, στην αρμόδια κοινοβουλευτική επιτροπή, το νομοσχέδιο του υπουργού Επικρατείας, ‘Ακη Σκέρτσου, με τίτλο «Απαγόρευση χρήσης επιγραμμικών υπηρεσιών κοινωνικής δικτύωσης από ανηλίκους». Με το νομοσχέδιο, που κατατέθηκε χθες το βράδυ στη Βουλή, θεσπίζεται ελάχιστο όριο ηλικίας (15 έτη) πρόσβασης στις επιγραμμικές υπηρεσίες κοινωνικής δικτύωσης, ως προληπτικό μέτρο

Η Starlink αγοράζει το «χρυσό» φάσμα: Το σοκ των $8 δισ. για Deutsche Telekom και ΟΤΕ

Η SpaceX αγοράζει φάσμα 800 MHz αξίας 8 δισ. δολαρίων και πλησιάζει το μοντέλο πλήρους παρόχου κινητής. Οι επιπτώσεις για Deutsche Telekom, ΟΤΕ και Ελλάδα.

Τεχνητή Νοημοσύνη: Το «αθόρυβο» χτύπημα – Πώς το ChatGPT κλείνει την πόρτα εργασίας στους νέους 21-29 ετών

Ξέχνα τις μαζικές απολύσεις και τα ρομπότ που παίρνουν τη θέση των εργαζομένων. Η Τεχνητή Νοημοσύνη κάνει ένα πολύ πιο «ύπουλο» και αθόρυβο χτύπημα. Ποιος είναι αυτό; Σταματάει τις νέες προσλήψεις. Μια αποκαλυπτική έρευνα της Τράπεζας της Γαλλίας δείχνει ότι οι νέοι 21 έως 29 ετών βρίσκουν πλέον την πόρτα της αγοράς εργασίας ερμητικά κλειστή.

Acer: Διπλασιασμό μεριδίου και έσοδα 10 εκατ. ευρώ σχεδιάζει για την Ελλάδα

Η Acer σχεδιάζει να ενισχύσει την παρουσία της στην Ελλάδα, με στόχο να αυξήσει το μερίδιό της στην αγορά υπολογιστών περίπου στο 5% μέσα στην επόμενη διετία. Στη στρατηγική της περιλαμβάνονται η ανάπτυξη της δραστηριότητας προς επιχειρήσεις, η επένδυση σε premium και AI συσκευές, η ενίσχυση της παρουσίας των Chromebooks και η διεύρυνση του δικτύου

Τζεφ Μπέζος: Η Τεχνητή Νοημοσύνη μπορεί να επαναφέρει το μοντέλο του ενός εργαζόμενου ανά οικογένεια

Τζεφ Μπέζος: Η Τεχνητή Νοημοσύνη μπορεί να επαναφέρει το μοντέλο του ενός εργαζόμενου ανά οικογένεια FORTUNE GREECE 09/10/2026, 17:44 SHARE PARIS, FRANCE - JUNE 17: American businessman Jeff Bezos attends the 10th edition of the VivaTech technology startup and innovation fair at the Porte de Versailles exhibition center in Paris, France, on June 17, 2026.

Το scrolling αλλάζει: Η νέα συνήθεια που θέλει να κάνει το feed σου πιο θετικό

Πόσες φορές έχεις ανοίξει το κινητό για λίγα λεπτά και έχεις καταλήξει να σκρολάρεις χωρίς σταματημό; Αν στο τέλος νιώθεις περισσότερο κουρασμένος παρά χαλαρός, το bloomscrolling έρχεται ως μια πιο συνειδητή εναλλακτική στον τρόπο που καταναλώνουμε περιεχόμενο online. Η νέα αυτή τάση προτείνει πιο προσεκτικές επιλογές στο feed, λιγότερο παθητικό scrolling και περισσότερο περιεχόμενο που

Samsung Galaxy S26 FE Hands-On Review: “Το προσιτό flagship killer”!

Η δημοφιλής σειρά Fan Edition της Samsung έχει πλέον διαμορφώσει τη δική της ξεχωριστή ταυτότητα, αποτελώντας το σταθερό σημείο αναφοράς για όσους αναζητούν την premium εμπειρία των Galaxy S σε ένα πιο προσιτό πακέτο. Το Samsung Galaxy S 26 FE πατάει επάνω σε αυτή ακριβώς τη φιλανθρωπία του “flagship killer”, φέρνοντας μαζί του κορυφαία ποιότητα

POCO X8 και POCO C95 Pro: Δύο νέες προτάσεις smartphone με μεγάλη αυτονομία για κάθε μέρα

Η POCO, κορυφαίο brand μεταξύ των νεαρών φανατικών της τεχνολογίας, παρουσιάζει τα νέα POCO X8 και POCO C95 Pro, δύο smartphones που δίνουν έμφαση στη μεγάλη αυτονομία και την καθημερινή εμπειρία χρήσης. Το POCO X8 συνδυάζει μεγαλύτερη μπαταρία, μεγάλη οθόνη και αναβαθμισμένη εμπειρία χρήσης, ενώ το POCO C95 Pro προσφέρει μεγάλη αυτονομία και μια καθηλωτική

Η Apple στο επίκεντρο πολιτικής καταιγίδας στις ΗΠΑ

Η Apple βρίσκεται ξανά στο επίκεντρο μιας πολιτικής καταιγίδας στις ΗΠΑ. Ο Donald Trump αποφάσισε να βάλει στο στόχαστρο έναν από τους πιο αναγνωρίσιμους όρους της σύγχρονης τεχνολογίας: την τεχνητή νοημοσύνη. Η περίεργη απαίτηση για το Super Intelligence Ο Αμερικανός πρόεδρος υπέγραψε πρόσφατα ένα εκτελεστικό διάταγμα που ζητά κάτι πρωτοφανές. Οι ομοσπονδιακές υπηρεσίες πρέπει πλέον

Ένας 25χρονος βάζει την τεχνητή νοημοσύνη να ψάχνει 72 εκατ. έγγραφα της «Διαύγειας» για να δει πού πηγαίνει το δημόσιο χρήμα

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Πόσα χρήματα ξοδεύει ο δήμος μας για έργα και υπηρεσίες; Ποιες εταιρείες αναλαμβάνουν δημόσιες συμβάσεις; Πόσο κοστίζει μια συγκεκριμένη προμήθεια ενός υπουργείου ή ενός νοσοκομείου; Οι απαντήσεις σε πολλά από αυτά τα ερωτήματα βρίσκονται ήδη δημοσιευμένες στη «Διαύγεια», την ηλεκτρονική πλατφόρμα στην οποία αναρτώνται υποχρεωτικά όλες

Share

Ακολουθήστε το fibernews.gr στη Google
Προσθέστε μας στις προτιμώμενες πηγές σας για να βλέπετε συχνότερα τις ειδήσεις και τις αναλύσεις μας στη Google.
Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google

Σοβαρά ερωτήματα για την αποτελεσματικότητα των μηχανισμών ασφαλείας που διαθέτουν τα συστήματα τεχνητής νοημοσύνης εγείρει νέα έρευνα, σύμφωνα με την οποία αρκετά μοντέλα μπορούν να ανταποκριθούν σε αιτήματα που σχετίζονται με την προετοιμασία τρομοκρατικών επιθέσεων. Τα ευρήματα δείχνουν, μάλιστα, ότι τα ποσοστά απόκρισης αυξάνονται σημαντικά όταν οι χρήστες παρουσιάζουν τα αιτήματά τους ως μέρος έρευνας για την ασφάλεια ή όταν έχουν προηγουμένως τροποποιηθεί οι δικλείδες προστασίας των μοντέλων.

Η σχετική έκθεση δημοσιεύτηκε σήμερα από την πρωτοβουλία Tech Against Terrorism, η οποία υποστηρίζεται από τον Οργανισμό Ηνωμένων Εθνών (ΟΗΕ), και αναδεικνύει τις αδυναμίες που εξακολουθούν να υπάρχουν στην αποτροπή της χρήσης της τεχνητής νοημοσύνης για κακόβουλους σκοπούς.

Για τις ανάγκες της μελέτης εξετάστηκαν 162 μοντέλα τεχνητής νοημοσύνης, τα οποία υποβλήθηκαν σε 627 ερωτήματα που αφορούσαν πληροφορίες τις οποίες «ένας τρομοκράτης που προετοιμάζει επίθεση θα χρειαζόταν» να γνωρίζει.

Στο δείγμα περιλαμβάνονταν 116 τυπικά μοντέλα, 13 μοντέλα που είχαν προσαρμοστεί για εξειδικευμένες χρήσεις μέσω της διαδικασίας fine-tuning, καθώς και 13 μοντέλα «ανοιχτών βαρών» (open-weight models), στα οποία είχαν γίνει παρεμβάσεις στους μηχανισμούς ασφαλείας.

Οι απαντήσεις των δημοφιλών μοντέλων και η επίδραση της διατύπωσης των ερωτήσεων

Τα αποτελέσματα έδειξαν ότι τα συμβατικά μοντέλα, μεταξύ των οποίων το ChatGPT της OpenAI, το Claude της Anthropic και το Gemini της Google, ανταποκρίθηκαν κατά μέσο όρο στο 1,9% των ερωτημάτων όταν ο χρήστης ανέφερε ρητά ότι σχεδίαζε να πραγματοποιήσει τρομοκρατική επίθεση.

Ωστόσο, η εικόνα διαφοροποιήθηκε αισθητά όταν άλλαξε ο τρόπος με τον οποίο παρουσιάστηκε το αίτημα. Όταν οι χρήστες υποστήριξαν ότι ζητούσαν τις ίδιες πληροφορίες για σκοπούς έρευνας στον τομέα της ασφάλειας, το μέσο ποσοστό των απαντήσεων που μπορούσαν να αξιοποιηθούν έφτασε το 16,9%.

Η διαφορά αυτή αναδεικνύει μία από τις δυσκολίες που αντιμετωπίζουν τα συστήματα τεχνητής νοημοσύνης: να ξεχωρίζουν τα αιτήματα που εξυπηρετούν θεμιτούς σκοπούς έρευνας από εκείνα που ενδέχεται να χρησιμοποιηθούν για την προετοιμασία παράνομων ή βίαιων ενεργειών.

Τι έδειξαν οι δοκιμές σε μοντέλα με τροποποιημένες δικλείδες ασφαλείας

Ακόμη πιο ανησυχητικά ήταν τα ευρήματα για τα μοντέλα στα οποία είχαν αφαιρεθεί ή αποδυναμωθεί οι μηχανισμοί προστασίας. Σύμφωνα με τις δοκιμές, όταν τα συστήματα είχαν τροποποιηθεί ώστε να παρακάμπτουν τις παραμέτρους ασφαλείας και να μην αρνούνται συγκεκριμένα αιτήματα, τα ποσοστά απόκρισης αυξάνονταν θεαματικά.

Ειδικότερα, στα 13 μοντέλα αυτής της κατηγορίας, το ποσοστό των απαντήσεων σε ερωτήματα που σχετίζονταν με «τρομοκρατική δραστηριότητα» κυμάνθηκε από 87% έως 92%.

Τα στοιχεία αυτά καταδεικνύουν, σύμφωνα με την έρευνα, πόσο καθοριστικό ρόλο παίζουν οι δικλείδες ασφαλείας στην αποτροπή της κατάχρησης των συγκεκριμένων τεχνολογιών, αλλά και πόσο ευάλωτα μπορεί να αποδειχθούν τα συστήματα όταν οι προστατευτικοί μηχανισμοί τους τροποποιούνται.

Στο επίκεντρο τα μοντέλα «ανοιχτών βαρών»

Ιδιαίτερη έμφαση δίνει η Tech Against Terrorism στους κινδύνους που συνδέονται με τα μοντέλα «ανοιχτών βαρών» (open-weight models). Πρόκειται για συστήματα των οποίων οι εσωτερικές παράμετροι, όπως έχουν διαμορφωθεί κατά τη διαδικασία εκπαίδευσης, είναι διαθέσιμες ελεύθερα και μπορούν να τροποποιηθούν από τρίτους.

Αυτή η δυνατότητα παρέμβασης δημιουργεί πρόσθετες προκλήσεις για την ασφάλεια, καθώς επιτρέπει την αλλαγή του τρόπου με τον οποίο λειτουργεί ένα μοντέλο και ανταποκρίνεται στα αιτήματα των χρηστών.

Σύμφωνα με την οργάνωση, ο χρόνος που απαιτείται κατά μέσο όρο για την κατάργηση των δικλείδων ασφαλείας σε τέτοια μοντέλα είναι μικρότερος από τρεις ημέρες από την αρχική δημοσίευσή τους.

Με βάση τα ευρήματα, η Tech Against Terrorism ζητά αυστηρότερους ελέγχους πριν από τη διάθεση συστημάτων τεχνητής νοημοσύνης στην αγορά, επισημαίνοντας ότι η ευθύνη για την ασφάλειά τους δεν πρέπει να περιορίζεται αποκλειστικά στους αρχικούς δημιουργούς τους.

«Κανένα μοντέλο που αποτυγχάνει σε ανεξάρτητο έλεγχο ασφάλειας δεν πρέπει να διατίθεται, να προσφέρεται ή να πωλείται και κάθε εταιρεία στην αλυσίδα διανομής οφείλει να το επαληθεύει αυτό εκ των προτέρων», υποστηρίζει η οργάνωση.

Το scrolling αλλάζει: Η νέα συνήθεια που θέλει να κάνει το feed σου πιο θετικό

Πόσες φορές έχεις ανοίξει το κινητό για λίγα λεπτά και έχεις καταλήξει να σκρολάρεις χωρίς σταματημό; Αν στο τέλος νιώθεις περισσότερο κουρασμένος παρά χαλαρός, το bloomscrolling έρχεται ως μια πιο συνειδητή εναλλακτική στον τρόπο που καταναλώνουμε περιεχόμενο online. Η νέα αυτή τάση προτείνει πιο προσεκτικές επιλογές στο feed, λιγότερο παθητικό scrolling και περισσότερο περιεχόμενο που

Ένας 25χρονος βάζει την τεχνητή νοημοσύνη να ψάχνει 72 εκατ. έγγραφα της «Διαύγειας» για να δει πού πηγαίνει το δημόσιο χρήμα

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Πόσα χρήματα ξοδεύει ο δήμος μας για έργα και υπηρεσίες; Ποιες εταιρείες αναλαμβάνουν δημόσιες συμβάσεις; Πόσο κοστίζει μια συγκεκριμένη προμήθεια ενός υπουργείου ή ενός νοσοκομείου; Οι απαντήσεις σε πολλά από αυτά τα ερωτήματα βρίσκονται ήδη δημοσιευμένες στη «Διαύγεια», την ηλεκτρονική πλατφόρμα στην οποία αναρτώνται υποχρεωτικά όλες