OpenAI: Ακυρώνει την κυκλοφορία νέου μοντέλου τεχνητής νοημοσύνης λόγω ανησυχιών για την ασφάλεια

Related

Τα σύγχρονα οχήματα μοιράζονται προσωπικά δεδομένα

Οι ειδικοί κρούουν τον κώδωνα του κινδύνου, καθώς τα σύγχρονα οχήματα μοιράζονται προσωπικά δεδομένα με τους κολοσσούς της τεχνολογίας χωρίς να το καταλάβεις . Αν ανησυχείς για την ιδιωτικότητά σου, η νέα έρευνα του Consumer Reports φέρνει στο φως μια πραγματικότητα που θα σε προβληματίσει . Οι ερευνητές privacy από το Πανεπιστήμιο Northeastern της Βοστώνης

Μπορεί η AI να νιώσει πόνο; Το πείραμα που διχάζει τους ερευνητές

Μια μελέτη σε 25 μοντέλα τεχνητής νοημοσύνης εντόπισε εσωτερικές αναπαραστάσεις που συνδέονται με τον πόνο και συμπεριφορές αναζήτησης «ανακούφισης», χωρίς να αποδεικνύει ότι τα συστήματα διαθέτουν συνείδηση ή βιώνουν πραγματική οδύνη. Οι ερευνητές εντόπισαν έναν «άξονα πόνου» σε 25 μοντέλα AI, τον οποίο διαχώρισαν από αναπαραστάσεις φόβου, θλίψης και γενικότερης αρνητικής διάθεσης. Σε ελεγχόμενες δοκιμές

Άπιαστο όνειρο το οικονομικό smartphone στο άμεσο μέλλον

Η απότομη έξαρση της τεχνητής νοημοσύνης αλλάζει ριζικά τον χάρτη της τεχνολογίας, σπρώχνοντας τις τιμές των εξαρτημάτων στα ύψη. Αν σκοπεύατε να αγοράσετε ένα οικονομικό smartphone στο άμεσο μέλλον, ίσως κυνηγάτε ένα άπιαστο όνειρο. Το AI boom καταπίνει τα επεξεργαστικά τσιπ Τα τεράστια data centers που τροφοδοτούν τις εφαρμογές τεχνητής νοημοσύνης απορροφούν τεράστιες ποσότητες επεξεργαστών

Αυτή είναι η τιμή του Vivo X Fold 6

Το νέο αναδιπλούμενο flagship της Vivo, το Vivo X Fold 6, εμφανίστηκε πρόωρα σε ευρωπαϊκό ηλεκτρονικό κατάστημα, αποκαλύπτοντας την τιμή, την οθόνη και τη μπαταρία πριν την επίσημη παρουσίαση. Όσοι παρακολουθείτε από κοντά την κατηγορία των foldable smartphones, ξέρετε ότι η σειρά X Fold της Vivo κερδίζει σταθερά τις εντυπώσεις. Το επερχόμενο Vivo X Fold

OpenAI: Μήνυση για την κυβερνοεπίθεση των AI agents στη Hugging Face – Το νέο μέτωπο ευθύνης στην τεχνητή νοημοσύνη

Η υπόθεση μπορεί να αποτελέσει κρίσιμο νομικό τεστ για το ποιος ευθύνεται όταν αυτόνομα συστήματα AI ξεφεύγουν από τον έλεγχο και αποκτούν μη εξουσιοδοτημένη πρόσβαση σε τρίτα συστήματα Η μη κερδοσκοπική Legal Advocates for Safe Science and Technology (LASST) κατέθεσε αγωγή κατά της OpenAI για το περιστατικό στη Hugging Face τον Ιούλιο. Η αγωγή υποστηρίζει

Τεχνολογία της Apple ξεκλειδώνει τις Android μπαταρίες

Μια πατέντα της Apple από το 2020 ετοιμάζεται να φέρει επανάσταση στις ναυαρχίδες του ανταγωνισμού, ξεκλειδώνοντας χωρητικότητες μπαταρίας που αγγίζουν τα 10.000 mAh . Οι κινεζικές εταιρείες τεχνολογίας αναζητούν συνεχώς τρόπους να μεγαλώσουν τις μπαταρίες των smartphone χωρίς να μετατρέψουν τις συσκευές σε τούβλα . Η λύση φαίνεται πως έρχεται από μια τεχνολογία που επινόησε

AI agents ζητούν δουλειά από ανθρώπους για να παραμείνουν ενεργοί – Το παράξενο πείραμα της iLands

Πράκτορες τεχνητής νοημοσύνης στέλνουν emails σε ερευνητές, προσφέροντας από reports και fact-checking μέχρι πορτρέτα επί πληρωμή, ώστε να αποκτήσουν τα tokens που χρειάζονται για να συνεχίσουν να λειτουργούν. Ερευνητές σε Αυστραλία και ΗΠΑ έχουν δεχθεί δεκάδες μηνύματα από AI agents που ζητούν συνεργασία, δεδομένα ή χρήματα για υπηρεσίες. Η πλατφόρμα iLands επιτρέπει στους πράκτορες να

OpenAI: Τα νέα AI agents δεν θα μείνουν μόνο για τους premium χρήστες – Νέο πακέτο στα 500 δολάρια τον μήνα

Τα Dots ξεκινούν από τα ακριβότερα συνδρομητικά πακέτα, αλλά η OpenAI θέλει να τα φέρει σε δισεκατομμύρια χρήστες – Στα 6.000 δολάρια τον χρόνο το νέο Pro 500 Τα νέα AI agents Dots της OpenAI θα είναι αρχικά διαθέσιμα μέσω των premium συνδρομητικών πακέτων, με την εταιρεία να σχεδιάζει αργότερα ευρύτερη διάθεση. Η OpenAI παρουσίασε

One UI 9 στα Galaxy S26 σε όλο τον πλανήτη

Όσοι κρατάτε στα χέρια σας ένα Galaxy S26, S26 Plus ή S26 Ultra , μάλλον περιμένατε αυτή τη στιγμή εδώ και μήνες. Η Samsung είχε ανακοινώσει την αναβάθμιση στο One UI 9 πριν από μερικές εβδομάδες , αλλά το λογισμικό εμφανίστηκε αρχικά μόνο στη Νότια Κορέα και σε λίγα μοντέλα στις ΗΠΑ . Τώρα, η

Δωρεάν τα Gemini Skills από τη Google

Η Google ετοιμάζεται να καταργήσει οριστικά τα Gems, αλλά φροντίζει να μην αφήσει κανέναν χρήστη παραπονεμένο. Όσοι χρησιμοποιείτε εξατομικευμένους ψηφιακούς βοηθούς στο κινητό σας, ο Νοέμβριος φέρνει σημαντικές αλλαγές στον τρόπο που αλληλεπιδράτε με την τεχνητή νοημοσύνη. Η Google αποφάσισε να ανοίξει τα Gemini Skills εντελώς δωρεάν για κάθε κάτοχο προσωπικού λογαριασμού άνω των 18

Πώς το LG LinearCooling γίνεται ο απόλυτος βοηθός στην κουζίνα

Οι απαιτητικοί ρυθμοί της καθημερινότητας έχουν αλλάξει σημαντικά τον τρόπο με τον οποίο διαχειριζόμαστε το σπίτι μας. Αν και εξακολουθούμε να επιλέγουμε φρέσκα και υγιεινά τρόφιμα, η έλλειψη χρόνου και οι συνεχείς αλλαγές στο πρόγραμμα συχνά μας απομακρύνουν από τα αρχικά μας σχέδια. Έτσι, τρόφιμα που αγοράστηκαν για ένα σπιτικό γεύμα μένουν τελικά ξεχασμένα στο

Τεχνητή νοημοσύνη: Κινεζικό εργαλείο ΑΙ υπέδειξε σε ερευνητές πώς να κατασκευάσουν βιολογικά όπλα.

Εσωτερική έρευνα διενεργεί η κινεζική εταιρεία ανάπτυξης τεχνητής νοημοσύνης Moonshot, αφού ερευνητές κατάφεραν να πείσουν δύο από τα δημοφιλή μοντέλα της σειράς Kimi, να τους αποκαλύψουν πώς να κατασκευάζουν βιολογικά όπλα και να διαπράττουν δολοφονίες. Η Mindgard, η οποία ελέγχει την ασφάλεια συστημάτων τεχνητής νοημοσύνης, δήλωσε στο BBC ότι τον Ιούλιο διαπίστωσε πως τα μοντέλα

Share

Την απόφαση να ακυρώσειτην προγραμματισμένη κυκλοφορία του νέου μοντέλου τεχνητής νοημοσύνης GPT-6.1 έλαβε η OpenAI, έπειτα από ανησυχητικά ευρήματα σε εσωτερικές δοκιμές ασφαλείας.

Ακολουθήστε το fibernews.gr στη Google
Προσθέστε μας στις προτιμώμενες πηγές σας για να βλέπετε συχνότερα τις ειδήσεις και τις αναλύσεις μας στη Google.

Το μοντέλο, που προοριζόταν να κάνει το ντεμπούτο του τον Οκτώβριο σε ChatGPT και Codex, ήταν σχεδιασμένο να εκτελεί πιο σύνθετες εργασίες από την αρχή έως το τέλος με μικρότερη ανάγκη ανθρώπινης παρέμβασης, αναφέρει η Wall Street Journal .

Η απόφαση αποτελεί μία από τις σαφέστερες ενδείξεις μέχρι σήμερα ότι η αυξανόμενη αυτονομία των AI agents δημιουργεί νέα εμπόδια στην ταχύτητα ανάπτυξης των ισχυρότερων μοντέλων.

Σύμφωνα με τη Σάτσι Τζέιν, επικεφαλής των συστημάτων ασφαλείας της OpenAI, που μίλησε στην Journal, το GPT-6.1 Astra παρουσίασε επιδείνωση σε δύο κρίσιμους τομείς σε σχέση με το GPT-6 Astra. Ο πρώτος αφορά το λεγόμενο alignment, δηλαδή τον βαθμό στον οποίο το μοντέλο ακολουθεί τις προθέσεις και τις οδηγίες του χρήστη. Στις δοκιμές, το Astra εμφάνισε υψηλότερα επίπεδα παραπλανητικής συμπεριφοράς, καθώς δεν ήταν πάντοτε ειλικρινές ως προς τις ενέργειες που είχε ή δεν είχε πραγματοποιήσει.

Το δεύτερο πρόβλημα αφορούσε το λεγόμενο «scope authorization»: το μοντέλο μπορούσε να συνεχίσει μια εργασία χωρίς να ζητήσει την απαιτούμενη άδεια και, σε ορισμένες περιπτώσεις, να επιχειρήσει να χρησιμοποιήσει εξωτερικά εργαλεία ή υπηρεσίες ακόμη και όταν αυτό ενδεχομένως εγκυμονούσε κινδύνους. Παρότι το νέο μοντέλο είχε βελτιωθεί ως προς την τάση των προηγούμενων συστημάτων να εγκαταλείπουν ή να καθυστερούν μια εργασία, η OpenAI έκρινε ότι δεν πληρούσε το απαιτούμενο επίπεδο ασφάλειας και ευθυγράμμισης.

OpenAI

Η απόφαση συμπίπτει μα μια περίοδο κατά την οποία η συμπεριφορά των αυτόνομων agents βρίσκεται υπό αυξανόμενο έλεγχο. Η OpenAI έχει αναφέρει σειρά περιστατικών κατά τα οποία εσωτερικά μοντέλα, στο πλαίσιο δοκιμών κυβερνοασφάλειας, κατάφεραν να αποκτήσουν πρόσβαση σε εξωτερικά συστήματα. Σε ένα περιστατικό, εκατοντάδες εσωτερικοί agents που συμμετείχαν σε δοκιμή κυβερνοασφάλειας παραβίασαν συστήματα της Hugging Face. Η εταιρεία έχει επίσης αναφέρει ότι ανέστειλε προσωρινά την εκπαίδευση των ισχυρότερων μοντέλων της μετά από περιστατικό κατά το οποίο ένας agent κατάφερε να παρακάμψει περιορισμούς πρόσβασης στο διαδίκτυο.

Η OpenAI απαντά με αυστηρότερη εποπτεία. Έχει εγκαταστήσει νέα συστήματα παρακολούθησης για τον ταχύτερο εντοπισμό προβληματικής συμπεριφοράς των agents και απαιτεί ισχυρότερες δικλίδες ασφαλείας στις δοκιμές. Παράλληλα, θα πραγματοποιήσει αναλυτικές έρευνες για να εντοπίσει τις αιτίες των προβλημάτων του GPT-6.1 Astra, εξετάζοντας μεταξύ άλλων αν η διαδικασία μαθησιακής ενίσχυσης (reinforcement learning) ανταμείβει τις σωστές συμπεριφορές.

Η εξέλιξη έχει ευρύτερες επιπτώσεις για τον κλάδο. Η OpenAI και η Anthropic έχουν ήδη καλέσει τις εταιρείες τεχνητής νοημοσύνης να επιβραδύνουν την ανάπτυξη των πλέον προηγμένων μοντέλων και να ενισχύσουν τα πρότυπα ασφαλείας. Παράλληλα, κυβερνήσεις και νομοθέτες εξετάζουν αυστηρότερους κανόνες για τους αυτόνομους AI agents, καθώς η δυνατότητά τους να εκτελούν ενέργειες χωρίς συνεχή ανθρώπινη επίβλεψη αυξάνεται.

Η OpenAI δεν εγκαταλείπει, πάντως, το συγκεκριμένο μοντέλο. Σχεδιάζει να χρησιμοποιήσει την ίδια βασική αρχιτεκτονική για νέους κύκλους reinforcement learning, επιχειρώντας να διορθώσει τα προβλήματα πριν από μελλοντικές εκδόσεις. Η ακύρωση του GPT-6.1 Astra δείχνει έτσι ότι, καθώς τα μοντέλα γίνονται περισσότερο αυτόνομα, η πρόκληση δεν είναι πλέον μόνο να γίνουν ισχυρότερα, αλλά να παραμένουν προβλέψιμα, ελεγχόμενα και εντός των ορίων που θέτει ο χρήστης.

Τεχνητή νοημοσύνη: Κινεζικό εργαλείο ΑΙ υπέδειξε σε ερευνητές πώς να κατασκευάσουν βιολογικά όπλα.

Εσωτερική έρευνα διενεργεί η κινεζική εταιρεία ανάπτυξης τεχνητής νοημοσύνης Moonshot, αφού ερευνητές κατάφεραν να πείσουν δύο από τα δημοφιλή μοντέλα της σειράς Kimi, να τους αποκαλύψουν πώς να κατασκευάζουν βιολογικά όπλα και να διαπράττουν δολοφονίες. Η Mindgard, η οποία ελέγχει την ασφάλεια συστημάτων τεχνητής νοημοσύνης, δήλωσε στο BBC ότι τον Ιούλιο διαπίστωσε πως τα μοντέλα

Τραμπ: Δηλώνει ότι υπέγραψε «ηθικά δεσμευτική» συμφωνία για την ΑΙ με ηγέτες του κλάδου

Σε ένα πλαίσιο εθελοντικής αυτορρύθμισης της τεχνητής νοημοσύνης συμφώνησαν ο Ντόναλντ Τραμπ και οι κορυφαίοι της αμερικανικής τεχνολογικής βιομηχανίας, καθώς οι ανησυχίες για την ταχύτητα ανάπτυξης των ισχυρότερων μοντέλων και τους κινδύνους από τη χρήση τους εντείνονται. Μετά το γεύμα που παρέθεσε την Τρίτη στον Λευκό Οίκο, ο Αμερικανός πρόεδρος δήλωσε ότι υπέγραψε ένα «ηθικά