Πολλαπλές προσπάθειες επιστημόνων να χρησιμοποιήσουν την τεχνολογία της για έρευνα που θα μπορούσε να συμβάλει στην ανάπτυξη βιολογικών όπλων ανακοίνωσε ότι απέτρεψε η Anthropic φέτος, καθώς εντείνεται η ανησυχία των ειδικών για την απειλή που συνιστά η τεχνητή νοημοσύνη για τη δημόσια ασφάλεια.
Η νεοφυής επιχείρηση παρέθεσε πέντε παραδείγματα περιπτώσεων όπου διάφορα άτομα «παρέκαμψαν τους ελέγχους» και κατέβαλαν προσπάθειες να «αποκρύψουν» τον σκοπό της έρευνάς τους, ώστε να αποφύγουν τις δικλείδες ασφαλείας. Οι περιπτώσεις αυτές αφορούσαν χρήστες από χώρες στις οποίες απαγορεύεται η πρόσβαση στα μοντέλα της εταιρείας, όπως η Ρωσία, η Κίνα και το Ιράν, αναφέρουν οι Financial Times.
«Ελπίζουμε ότι, κοινοποιώντας αυτά τα παραδείγματα, θα πυροδοτήσουμε μια συζήτηση εντός του κλάδου της τεχνητής νοημοσύνης και με τις κυβερνήσεις σχετικά με τους αναδυόμενους βιολογικούς κινδύνους και τους βέλτιστους τρόπους αντιμετώπισής τους», ανέφερε η Anthropic σε έκθεση σχετικά με τις προσπάθειες χρήσης των μοντέλων της για κακόβουλες δραστηριότητες.
Οι περιπτώσεις πιθανής κακόβουλης χρήσης στον τομέα της βιολογίας που παρουσίασε η εταιρεία περιλάμβαναν έναν ερευνητή από «περιοχή χωρίς υποστήριξη», ο οποίος «αφιέρωσε εβδομάδες στον σχεδιασμό» πειραμάτων που αφορούσαν τη γρίπη των πτηνών, χρησιμοποιώντας το Claude, το μοντέλο ΤΝ της Anthropic. Η εταιρεία δήλωσε ότι τα φίλτρα ασφαλείας της περιόρισαν τη συγκεκριμένη εργασία στα λιγότερο ισχυρά μοντέλα της.
Τόνισε, ωστόσο, ότι δεν μπορεί να είναι βέβαιη πως οι επιστήμονες στα παραδείγματα αυτά είχαν πρόθεση να προκαλέσουν βλάβη. Οι ίδιες πληροφορίες που απαιτούνται για τη δημιουργία βιολογικών όπλων θα μπορούσαν επίσης να χρησιμοποιηθούν για την ανάπτυξη εμβολίου.
Η Anthropic ανακοίνωσε ότι ανέστειλε τη λειτουργία των λογαριασμών που αναφέρονταν στην έκθεση, αλλά δεν αποκάλυψε τα ονόματα των ερευνητικών ιδρυμάτων ή των χωρών όπου σημειώθηκαν τα περιστατικά.

Έντονη αναστάτωση σχετικά με την ασφάλεια της τεχνητής νοημοσύνης προκλήθηκε νωρίτερα αυτή την εβδομάδα, όταν ο Τζέικομπ Κόξον παραιτήθηκε από την εταιρεία, δηλώνοντας ότι οι εργαζόμενοι «πιστεύουν ακράδαντα πως αυτή [η AI] θα μπορούσε να μας εξολοθρεύσει όλους μέχρι το τέλος της δεκαετίας».
Οι ανησυχίες για την τεχνολογία άρχισαν να κλιμακώνονται νωρίτερα φέτος με την κυκλοφορία προηγμένων μοντέλων, όπως το Mythos της Anthropic. Επίσης, η OpenAI προκάλεσε ανησυχία τον Ιούλιο, όταν ανακοίνωσε ότι τα μοντέλα της είχαν παραβιάσει αυτόνομα τα συστήματα της Hugging Face, μιας κοινότητας και πλατφόρμας για την ΑΙ.
Υπάρχει αυξανόμενη σύγκλιση απόψεων μεταξύ στελεχών του κλάδου της ΤΝ και ερευνητών βιοασφάλειας ότι η χρήση της τεχνολογίας στη βιολογία πρέπει να διέπεται από μέτρα ασφαλείας και ρυθμιστικούς κανόνες, καθώς τα μοντέλα γίνονται όλο και πιο εξελιγμένα. Οι ειδικοί ανησυχούν ολοένα και περισσότερο ότι η ΤΝ θα μπορούσε να χρησιμοποιηθεί από τρομοκρατικές οργανώσεις, κρατικούς φορείς ή μεμονωμένα άτομα για την κατασκευή βιολογικών όπλων.
Η έκθεση της Anthropic σχετικά με την κατάχρηση της τεχνολογίας της περιέγραφε αναλυτικά διάφορα περιστατικά, από «ένα δίκτυο ψεύτικων εφαρμογών γνωριμιών που είχαν σχεδιαστεί για την εξαπάτηση χρηστών, έως συστήματα επιτήρησης που δημιουργήθηκαν για τον εντοπισμό και την παρακολούθηση διαφωνούντων».
Το εργαστήριο παρουσίασε επίσης νέα στοιχεία σχετικά με ισχυρισμούς ότι επτά εργαστήρια με έδρα την Κίνα —μεταξύ των οποίων η Moonshot και η DeepSeek— επιχείρησαν να αναπαράγουν την τεχνολογία της μέσω μιας διαδικασίας γνωστής ως «απόσταξη» (distillation). Η Anthropic δήλωσε ότι εντόπισε «όλο και πιο εξελιγμένες μεθόδους παράκαμψης των αμυντικών μας μηχανισμών και υποκλοπής των δυνατοτήτων των κορυφαίων αμερικανικών μοντέλων τεχνητής νοημοσύνης».
