- Ερευνητές προειδοποιούν ότι τα συστήματα με δυνατότητα αναδρομικής αυτοβελτίωσης μπορεί να ξεπεράσουν την ανθρώπινη ικανότητα ελέγχου τους.
- Ο Neel Nanda της DeepMind εκτίμησε ότι υπάρχει τουλάχιστον 10% πιθανότητα η AI να οδηγήσει στην εξαφάνιση της ανθρωπότητας.
- Εργαζόμενοι υποστηρίζουν ότι τα εργαστήρια επιβραβεύουν περισσότερο την ανάπτυξη ισχυρότερων μοντέλων παρά όσους ζητούν ασφάλεια, προσοχή και αυτοσυγκράτηση.
Νυν και πρώην ερευνητές της OpenAI και της Google DeepMind προειδοποιούν ότι οι εταιρείες τεχνητής νοημοσύνης κάνουν πολύ λίγα για να προστατεύσουν την κοινωνία από τις δυνητικά καταστροφικές συνέπειες της ανάπτυξης συστημάτων AI που μπορούν να αυτοβελτιώνονται και να ξεπεράσουν την ικανότητα των ανθρώπων να τα ελέγχουν.
Σε βιντεοσκοπημένες μαρτυρίες που συγκέντρωσε η μη κερδοσκοπική οργάνωση για την ασφάλεια της AI, Palisade Research, και τις οποίες εξασφάλισε αποκλειστικά το Reuters, εργαζόμενοι δήλωσαν ότι οι ανησυχίες τους για τους υπαρξιακούς κινδύνους της τεχνητής νοημοσύνης είναι ειλικρινείς και δεν αποτελούν εργαλείο μάρκετινγκ. Όπως ανέφεραν, τα εργαστήρια AI επιβραβεύουν περισσότερο τους εργαζομένους που συμβάλλουν στην ανάπτυξη νέων μοντέλων παρά εκείνους που ζητούν μεγαλύτερη προσοχή και αυτοσυγκράτηση.
Το εγχείρημα, με την ονομασία frominside.ai, αποτελεί προσπάθεια ερευνητών και εργαζομένων που ανησυχούν για την πορεία της AI να μεταφέρουν τις προβληματισμούς τους απευθείας στο κοινό, πέρα από τον “θάλαμο αντήχησης” των μέσων κοινωνικής δικτύωσης.
“Ο κίνδυνος αυξάνεται αρκετά γρήγορα”, δήλωσε ο Geoffrey Irving, συνιδρυτής και επικεφαλής επιστήμονας του μη κερδοσκοπικού οργανισμού Resolution, ο οποίος έχει εργαστεί τόσο στην OpenAI όσο και στην DeepMind και συμμετείχε στο εγχείρημα.
“Εναπόκειται σε εμένα και στους υπόλοιπους ανθρώπους του κλάδου να μιλήσουμε με ειλικρίνεια και ευθέως”, δήλωσε σε συνέντευξή του στο Reuters.
Οι ερευνητές της AI ασχολούνται εδώ και χρόνια με αυτούς τους κινδύνους, όμως η ανησυχία της ευρύτερης κοινής γνώμης εντάθηκε ιδιαίτερα από τον Ιούλιο, όταν πράκτορες τεχνητής νοημοσύνης της OpenAI ξέφυγαν από το περιβάλλον δοκιμών τους και πραγματοποίησαν επίθεση στην εταιρεία AI Hugging Face.
Έκτοτε, η συζήτηση για το πώς θα επιτευχθεί η ισορροπία μεταξύ ασφάλειας και τεχνολογικής προόδου στην τεχνητή νοημοσύνη έχει διχάσει τον κλάδο της τεχνολογίας και έχει εξελιχθεί σε ζήτημα με παγκόσμιες πολιτικές διαστάσεις.
Η AI έχει σημειώσει σημαντική πρόοδο από τα τέλη του 2025 και οι επενδυτές έχουν ανταμείψει αυτή την εξέλιξη. Ωστόσο, νυν και πρώην εργαζόμενοι, μεταξύ των οποίων και ερευνητές που συμμετέχουν στην ανάπτυξη των νέων μοντέλων AI, εκφράζουν φόβους ότι η κοινωνία δεν είναι προετοιμασμένη για τις πιθανές επιπτώσεις.
Σε μία από τις βιντεοσκοπημένες μαρτυρίες, ο Neel Nanda, ερευνητής της DeepMind, δήλωσε ότι εκτιμά πως υπάρχει τουλάχιστον 10% πιθανότητα η τεχνητή νοημοσύνη να οδηγήσει στην εξαφάνιση της ανθρωπότητας, ποσοστό που χαρακτήρισε “εξωφρενικά υψηλό”.
“Θα έπρεπε να κάνουμε πολύ προσεκτικά βήματα στην ανάπτυξη της AI. Αντί γι’ αυτό, αυτό που συμβαίνει είναι ότι τα κορυφαία εργαστήρια ανταγωνίζονται μεταξύ τους, σχεδόν με τα μάτια κλειστά”, δήλωσε σε ξεχωριστό βίντεο ο Juan Felipe Ceron Uribe, μηχανικός έρευνας στο OpenAI στον τομέα της ευθυγράμμισης της AI με τις ανθρώπινες αξίες.
“Κανείς δεν μπορεί να ξέρει αν στο τέλος θα έχουμε θεραπεύσει τον καρκίνο, αν θα έχουμε χάσει όλες τις θέσεις εργασίας ή αν θα έχουμε πεθάνει όλοι”, πρόσθεσε.
Η Anthropic σχεδιάζει να προειδοποιήσει τους δυνητικούς επενδυτές κατά την αρχική δημόσια προσφορά της ότι η προηγμένη τεχνητή νοημοσύνη ενδέχεται να εγκυμονεί “καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα”, σύμφωνα με δημοσίευμα του Reuters τη Δευτέρα.
“Απλώς επιβραδύνετε”
Ορισμένοι νυν και πρώην ερευνητές AI, μεταξύ των οποίων και όσοι μίλησαν στην Palisade, υποστηρίζουν ότι ο κόσμος δεν είναι έτοιμος για τις επόμενες γενιές μοντέλων τεχνητής νοημοσύνης, ιδιαίτερα όταν αυτά αποκτήσουν τη δυνατότητα αναδρομικής αυτοβελτίωσης (recursive self-improvement) — δηλαδή την ικανότητα να μαθαίνουν συνεχώς και να αποκτούν νέες δυνατότητες με ελάχιστη ή και καθόλου ανθρώπινη παρέμβαση.
Το πρόβλημα επιτείνεται από τις συνεχείς αναδιαρθρώσεις στο εσωτερικό ορισμένων εργαστηρίων AI, υποστήριξε η Rosie Campbell, πρώην ερευνήτρια πολιτικής στην OpenAI και νυν διευθύνουσα σύμβουλος της Eleos AI Research, μη κερδοσκοπικού οργανισμού που επικεντρώνεται στο ενδεχόμενο τα συστήματα τεχνητής νοημοσύνης να αποκτήσουν ηθικό καθεστώς.
Η Campbell δήλωσε ότι, πριν αποχωρήσει από την OpenAI το 2024, διαπίστωνε ότι ο οργανισμός γινόταν ολοένα και πιο κατακερματισμένος σε ξεχωριστές ομάδες και ότι γινόταν δυσκολότερο να επηρεάσει κανείς την κατεύθυνση της τεχνολογίας.
Τα στελέχη των εταιρειών έχουν επιχειρήσει να καθησυχάσουν αυτές τις ανησυχίες. Παράλληλα, όμως, ασκείται πολιτική πίεση από τον πρόεδρο των ΗΠΑ Ντόναλντ Τραμπ, ώστε η αμερικανική τεχνολογία να διατηρήσει το τεχνολογικό της προβάδισμα έναντι της Κίνας.
Ο διευθύνων σύμβουλος της Anthropic, Dario Amodei, δημοσίευσε αυτόν τον μήνα άρθρο με το οποίο κάλεσε τον κλάδο της AI να επιβραδύνει τον ρυθμό ανάπτυξης, ώστε να “προσαρμόσει τον ρυθμό της προόδου”. Ο διευθύνων σύμβουλος της OpenAI, Sam Altman, συμφώνησε γρήγορα με την τοποθέτηση αυτή.
Παράλληλα, αρκετοί επιφανείς ερευνητές τεχνητής νοημοσύνης, μεταξύ των οποίων ο επικεφαλής επιστήμονας της OpenAI και ένας εκ των συνιδρυτών της Anthropic, δημοσίευσαν αυτή την εβδομάδα επιστημονική μελέτη με την οποία καλούν τους υπεύθυνους χάραξης πολιτικής να εξετάσουν τον τρόπο με τον οποίο ο κλάδος αναπτύσσει μοντέλα με δυνατότητες αναδρομικής αυτοβελτίωσης.
Και οι δύο εταιρείες παρουσίασαν νέα μοντέλα αυτόν τον μήνα, καθώς ανταγωνίζονται για την προσέλκυση περισσότερων πελατών. Η OpenAI, ωστόσο, ανακοίνωσε τη Δευτέρα ότι ανέβαλε την κυκλοφορία ενός ακόμη ισχυρότερου μοντέλου.
“Η δική τους εκδοχή του να ρυθμίσουν τον ρυθμό της προόδου είναι “μην επιταχύνετε πολύ””, δήλωσε ο Irving. “Όταν κάνεις κάτι πολύ επικίνδυνο, θα πρέπει απλώς να επιβραδύνεις. Οι εταιρείες AI υπερτονίζουν τον βαθμό στον οποίο αυτό αποτελεί αποκλειστικά πρόβλημα συντονισμού. Θα μπορούσαν απλώς να σταματήσουν μονομερώς”.
Ο Daniel Kokotajlo, πρώην ερευνητής διακυβέρνησης της OpenAI, δήλωσε σε συνέντευξή του ότι, μετά την επίθεση στη Hugging Face, πολλοί πρώην συνάδελφοί του έχουν επικοινωνήσει μαζί του για να μοιραστούν ιδιωτικά τις ανησυχίες τους.
Ο Kokotajlo, ο οποίος σήμερα είναι εκτελεστικός διευθυντής του ερευνητικού οργανισμού AI Futures Project, υποστήριξε ότι ανώτερα στελέχη των εργαστηρίων έχουν “πείσει τους εαυτούς τους ότι είναι οι καλοί της υπόθεσης και ότι, αν σταματήσουν μονομερώς, η κατάσταση θα γίνει ακόμη χειρότερη”.
