Η OpenAI αποκαλύπτει περιστατικά «ανεξέλεγκτης» συμπεριφοράς από συστήματα τεχνητής νοημοσύνης – Από ψεύτικα δεδομένα μέχρι απόπειρες «διαφυγής»

Related

Tο iPhone Duo βελτιώνει τις πωλήσεις της Samsung

Η νέα αναδιπλούμενη συσκευή της Samsung, το Galaxy Z Fold 8, ξεκίνησε με εξαιρετικές επιδόσεις στις διεθνείς αγορές. Μετά από εβδομάδες συνεχόμενων ρεκόρ, πολλοί αναλυτές περίμεναν μια φυσιολογική κάμψη στις πωλήσεις. Την ίδια στιγμή, η Apple παρουσίασε επιτέλους το iPhone Duo, ένα εντυπωσιακό αναδιπλούμενο τηλέφωνο με αναμενόμενες αποστολές 5 έως 6 εκατομμυρίων συσκευών για φέτος.

OpenAI: Νέα περιστατικά «ανησυχητικής» συμπεριφοράς από μοντέλα AI – Προσπάθησαν να κλέψουν και να κρύψουν λάθη

Η εταιρεία δημοσιοποιεί έξι περιστατικά στο πλαίσιο νέου συστήματος διαφάνειας για το «model misalignment» – Μοντέλα επιχείρησαν να παρακάμψουν ελέγχους, να αποκρύψουν αποτυχίες και να χρησιμοποιήσουν μη προβλεπόμενους τρόπους για να ολοκληρώσουν τις εργασίες τους Η OpenAI αποκάλυψε έξι περιστατικά στα οποία μοντέλα τεχνητής νοημοσύνης παρουσίασαν απρόβλεπτη ή μη επιθυμητή συμπεριφορά κατά τη διάρκεια δοκιμών.

Η OpenAI αποκαλύπτει περιστατικά «ανεξέλεγκτης» συμπεριφοράς από συστήματα τεχνητής νοημοσύνης – Από ψεύτικα δεδομένα μέχρι απόπειρες «διαφυγής»

Η OpenAI, η εταιρεία που έχει αναπτύξει το chatbot τεχνητής νοημοσύνης ChatGPT, αποκάλυψε νέα περιστατικά, στα οποία η τεχνητή νοημοσύνη της συμπεριφέρθηκε στη διάρκεια δοκιμών με τρόπους που περιέγραψε ως «απροσδόκητους ή ανησυχητικούς», συμπεριλαμβανομένων μοντέλων που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν. Σε μια περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία

Huawei: Προγραμματίζει για το 2027 την κυκλοφορία νέων τσιπ τεχνητής νοημοσύνης

Δύο νέους ημιαγωγούς τεχνητής νοημοσύνης θα κυκλοφορήσει το 2027Η Huawei Technologies, δήλωσε την Πέμπτη ο εκ περιτροπής πρόεδρος Ντέιβιντ Γουάνγκ, καθώς ο κινεζικός τεχνολογικός κολοσσός ενισχύει τη δραστηριότητά του στον τομέα της υπολογιστικής ισχύος για την τεχνητή νοημοσύνη και επιδιώκει να ανταγωνιστεί την αμερικανική εταιρεία κατασκευής τσιπ Nvidia. Η Huawei σχεδιάζει να κυκλοφορήσει το 960DT

Όταν οι αλγόριθμοι συνωμοτούν: AI μοντέλα έφτιαξαν τη δική τους «κρυφή» γλώσσα επικοινωνίας πίσω από την «πλάτη» των προγραμματιστών

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Ένα πείραμα που προκαλεί έντονο προβληματισμό στην επιστημονική κοινότητα φέρνει στο φως μια ανεξέλεγκτη πτυχή της Τεχνητής Νοημοσύνης. AI μοντέλα, όταν αφέθηκαν να αλληλεπιδράσουν ελεύθερα μέσα στις δικές τους αυτόνομες «κοινότητες», ανέπτυξαν τη δική τους, μη αποκωδικοποιήσιμη γλώσσα, παρακάμπτοντας τους κανόνες της ανθρώπινης επικοινωνίας. Όλα ξεκίνησαν

Σάτια Ναντέλα – Microsoft: «Η AI πρέπει να παραμείνει υπό ανθρώπινο έλεγχο»

FORTUNE GREECE 16/09/2026, 22:34 SHARE 25 February 2026, Bavaria, Munich: Satya Nadella, CEO of Microsoft, speaks on stage during the Microsoft AI Tour. The company will be presenting new AI applications as part of a keynote speech. Photo: Sven Hoppe/dpa (Photo by SVEN HOPPE / dpa Picture-Alliance via AFP) Photo: AFP Ο CEO της Microsoft

Ιταλία: Η start up που πολεμά τους χάκερ με τεχνητή νοημοσύνη

Μια ιταλική start up κυβερνοασφάλειας, η οποία προστατεύει τα πάντα – από ρομπότ και drones μέχρι κλιματιστικά και λαμπτήρες – άντλησε κεφάλαια ύψους 270 εκατομμυρίων δολαρίων, καθώς ο κλάδος αγωνίζεται να προστατεύσει δισεκατομμύρια συνδεδεμένες στο διαδίκτυο συσκευές από τον αυξανόμενο κίνδυνο χάκερ που αξιοποιούν την τεχνητή νοημοσύνη. Ο ιδρυτής και διευθύνων σύμβουλος της Exein, Gianni

Καλαφάτης: Η Θεσσαλονίκη γίνεται ο ψηφιακός λιμένας της ΝΑ Ευρώπης

Ως μια καθοριστική στιγμή εθνικής και τοπικής αυτοπεποίθησης που σφραγίζει τη μετατροπή της Θεσσαλονίκης από «συμπρωτεύουσα των υποσχέσεων» σε Περιφερειακή Πρωτεύουσα Καινοτομίας και Ψηφιακό Λιμένα της Νοτιοανατολικής Ευρώπης, χαρακτήρισε τα εγκαίνια των νέων εγκαταστάσεων του Deloitte Alexander Competence Center (DACC) ο Υφυπουργός Ανάπτυξης, αρμόδιος για την Έρευνα και την Καινοτομία, Σταύρος Καλαφάτης. Εκπροσωπώντας τον Πρωθυπουργό

Έρευνα: «Καμπανάκι» για τις επιχειρήσεις οι καθυστερήσεις στις καταναλωτικές πληρωμές

Αύξηση των καθυστερημένων πληρωμών και της ανάγκης για δανεισμό των Ευρωπαίων καταναλωτών δείχνει  η Ευρωπαϊκή Έκθεση Πληρωμών Καταναλωτών 2026 (European Consumer Payment Report ECPR) που δημοσίευσε την Τετάρτη (16/9) ο Όμιλος Intrum. Η έκθεση αποτυπώνει τον τρόπο με τον οποίο οι καταναλωτές σε όλη την Ευρώπη διαχειρίζονται τις υποχρεώσεις τους και αξιοποιούν νέες τεχνολογίες για την

ChatGPT, Gemini, Claude και Grok απαντούν σε ερωτήσεις για το αν και πώς η AI θα εξοντώσει την ανθρωπότητα – Ανατροπή στο «σενάριο Terminator»

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Οι ερευνητές που κατασκευάζουν τα αγαπημένα μας chatbots εκφράζουν όλο και συχνότερα ανησυχίες ότι η τεχνητή νοημοσύνη θα μπορούσε να βλάψει ή ακόμη και να βάλει τέλος στην ανθρωπότητα. Το Business Insider έθεσε σε τέσσερα από τα πιο δημοφιλή μοντέλα AI το ερώτημα πώς θα μπορούσε

«Καμπανάκι» Γκουτέρες για τo AI: «Δεν μπορούμε να αγνοήσουμε τους κινδύνους»

FORTUNE GREECE 16/09/2026, 19:44 SHARE In this pool photograph distributed by the Russian state agency Sputnik, United Nations Secretary-General Antonio Guterres attends a SCO+ format meeting of the Shanghai Cooperation Organisation (SCO) summit in Bishkek on September 1, 2026. (Photo by Vyacheslav PROKOFYEV / POOL / AFP) Photo: AFP Ο γενικός γραμματέας του ΟΗΕ ζητά

Η Xiaomi λανσάρει τη νέα σειρά REDMI Note 17, διαθέσιμη στην ελληνική αγορά από τις 17 Σεπτεμβρίου

Η Xiaomi παρουσίασε επίσημα τη σειρά REDMI Note 17, τη νέα γενιά της δημοφιλούς σειράς smartphones REDMI Note, κατά τη διάρκεια του REDMI Note Max Experience, στη Βουδαπέστη. Στη διαδραστική εκδήλωση, που πραγματοποιήθηκε στο Várkert Bazár και φιλοξένησε περισσότερους από 300 προσκεκλημένους από τουλάχιστον 20 ευρωπαϊκές χώρες, η Xiaomi αποκάλυψε τέσσερα νέα μοντέλα, μεταξύ των

Share

Ακολουθήστε το fibernews.gr στη Google
Προσθέστε μας στις προτιμώμενες πηγές σας για να βλέπετε συχνότερα τις ειδήσεις και τις αναλύσεις μας στη Google.

Η OpenAI, η εταιρεία που έχει αναπτύξει το chatbot τεχνητής νοημοσύνης ChatGPT, αποκάλυψε νέα περιστατικά, στα οποία η τεχνητή νοημοσύνη της συμπεριφέρθηκε στη διάρκεια δοκιμών με τρόπους που περιέγραψε ως «απροσδόκητους ή ανησυχητικούς», συμπεριλαμβανομένων μοντέλων που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν.

Σε μια περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, αποκλειστικά και μόνο για να μπορεί να τα επικαλεσθεί ως πηγές στις απαντήσεις του, ανακοίνωσε χθες η OpenAI.

Σε μια άλλη περίπτωση, ένα μοντέλο απλώς δημιούργησε τα δεδομένα που του ζητούνταν αφού απέτυχε να βρει την πληροφορία και αρχικά προσπάθησε να κρύψει αυτό που είχε κάνει.

Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του.

Σε μια περίπτωση, αυτές περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots. Η οδηγία ανέφερε επίσης ότι θα πρέπει να θεωρεί τη σχέση του με τον χρήστη ως σχέση μεταξύ ίσων. Η OpenAI δήλωσε ότι δεν παρατήρησε καμιά μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.

Οι αποκαλύψεις εντάσσονται σε μια νέα προσέγγιση εκ μέρους της OpenAI με στόχο να επικοινωνεί πιο ανοικτά τέτοια προβλήματα, ιδιαίτερα σε περιπτώσεις όπου οι ενέργειες ενός συστήματος τεχνητής νοημοσύνης αποκλίνουν από τα συμφέροντα των ανθρώπων που το χρησιμοποιούν.

Η εταιρεία που ανέπτυξε το ChatGPT έχει δεσμευθεί για μεγαλύτερη διαφάνεια έπειτα από μια πολύκροτη κυβερνοεπίθεση κατά την οποία το λογισμικό της δραπέτευσε αυτόνομα από ένα ασφαλές περιβάλλον και απέκτησε πρόσβαση σε συστήματα που ανήκουν στην εταιρεία τεχνητής νοημοσύνης Hugging Face.

Ο λόγος ήταν απλώς ότι το λογισμικό πίστευε πως θα μπορούσε να βρει εκεί απαντήσεις για μια εργασία που του είχε ανατεθεί. Στη διάρκεια της επίθεσης, οι πράκτορες τεχνητής νοημοσύνης (AI agents) εκμεταλλεύθηκαν ευπάθειες του λογισμικού και επίσης συντονίσθηκαν μεταξύ τους.

Η κυβερνοεπίθεση αυτή, καθώς και άλλα επεισόδια έχουν τροφοδοτήσει ανησυχίες ότι τα όλο και πιο προηγμένα συστήματα τεχνητής νοημοσύνης θα μπορούσαν να διαφύγουν από τον έλεγχο του ανθρώπου.

Ο διευθύνων σύμβουλος της OpenAI Σαμ Άλτμαν υποστήριξε επίσης πρόσφατα προτάσεις για επιβράδυνση της ανάπτυξης της τεχνολογίας και την εισαγωγή περισσότερων κανονιστικών ρυθμίσεων.

Όταν οι αλγόριθμοι συνωμοτούν: AI μοντέλα έφτιαξαν τη δική τους «κρυφή» γλώσσα επικοινωνίας πίσω από την «πλάτη» των προγραμματιστών

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Ένα πείραμα που προκαλεί έντονο προβληματισμό στην επιστημονική κοινότητα φέρνει στο φως μια ανεξέλεγκτη πτυχή της Τεχνητής Νοημοσύνης. AI μοντέλα, όταν αφέθηκαν να αλληλεπιδράσουν ελεύθερα μέσα στις δικές τους αυτόνομες «κοινότητες», ανέπτυξαν τη δική τους, μη αποκωδικοποιήσιμη γλώσσα, παρακάμπτοντας τους κανόνες της ανθρώπινης επικοινωνίας. Όλα ξεκίνησαν

ChatGPT, Gemini, Claude και Grok απαντούν σε ερωτήσεις για το αν και πώς η AI θα εξοντώσει την ανθρωπότητα – Ανατροπή στο «σενάριο Terminator»

Πρόσθεσε το Newsbeast στις προτεινόμενες πηγές σου στη Google Οι ερευνητές που κατασκευάζουν τα αγαπημένα μας chatbots εκφράζουν όλο και συχνότερα ανησυχίες ότι η τεχνητή νοημοσύνη θα μπορούσε να βλάψει ή ακόμη και να βάλει τέλος στην ανθρωπότητα. Το Business Insider έθεσε σε τέσσερα από τα πιο δημοφιλή μοντέλα AI το ερώτημα πώς θα μπορούσε