Η Google αποκάλυψε το νέο της κορυφαίο μοντέλο τεχνητής νοημοσύνης, το Gemini 4 Argon. Η εταιρεία σχεδίασε αυτό το σύστημα για να διατηρεί βαθιά αναλυτική σκέψη σε απαιτητικές εργασίες που διαρκούν ώρες ή ημέρες. Το Argon φέρνει επιδόσεις αιχμής στον προγραμματισμό, την εταιρική εργασία σε νομικά και οικονομικά, αλλά και την κυβερνοάμυνα.
Η διάθεση ξεκινά σταδιακά. Αρχικά, η Google δίνει πρόσβαση σε μια ομάδα έμπιστων αμυντικών κυβερνοασφάλειας μέσω του προγράμματος Fairwind. Η εταιρεία συνεργάζεται παράλληλα με την αμερικανική κυβέρνηση για τους απαραίτητους ελέγχους ασφαλείας, συλλέγοντας σχόλια από τους πρώτους δοκιμαστές πριν το ανοίξει στο ευρύ κοινό.
Όταν κυκλοφορήσει ευρύτερα, θα διατίθεται με αρχική τιμή $2 ανά εκατομμύριο token εισόδου και $10 ανά εκατομμύριο token εξόδου. Οι προσωρινά αποθηκευμένες είσοδοι θα έχουν έκπτωση 95%.
Πώς αλλάζει ο τρόπος εργασίας
μέσα στην ίδια τη Google
Το νέο μοντέλο ήδη τρέχει στο εσωτερικό της Google. Χιλιάδες εργαζόμενοι το χρησιμοποιούν καθημερινά για γρήγορη συγγραφή κώδικα, βαθιά έρευνα και βελτίωση της παραγωγικότητάς τους.
Βελτιστοποίηση κβαντικών αλγορίθμων: Ερευνητές της Google χρησιμοποίησαν το Argon για τη βελτιστοποίηση κβαντικών πόρων. Το μοντέλο ξεπέρασε το δημοσιευμένο σημείο αναφοράς κατά 40% μέσα σε λίγα λεπτά.
Εξοικονόμηση μνήμης σε Data Center: Argon agents ανέλυσαν τα τηλεμετρικά δεδομένα των υπολογιστικών υποδομών της Google. Εφάρμοσαν αυτόνομα βελτιώσεις μνήμης, ελευθερώνοντας πάνω από 300 TiB μνήμης, με τις συνολικές εκτιμήσεις να φτάνουν έως και το 1 PiB.
Μεταφορά κώδικα σε Rust: Το μοντέλο αναλαμβάνει τη μεταφορά παλαιότερων βιβλιοθηκών C/C++ σε Rust. Στη βιβλιοθήκη αποκωδικοποίησης βίντεο, αντικατέστησε 32.000 γραμμές κώδικα SIMD. Το αποτέλεσμα είναι ένας ασφαλής αποκωδικοποιητής που τρέχει 2.7 φορές γρηγορότερα.
Τεράστιο παράθυρο εξόδου
για πολύπλοκα προβλήματα
Για να υποστηρίξει τόσο απαιτητικά σενάρια, η Google αύξησε το όριο παραγωγής χαρακτήρων του Argon. Το μοντέλο μπορεί πλέον να παράγει έως και 1 εκατομμύριο tokens εξόδου σε μία μόνο εκτέλεση, από 64.000 που ήταν το προηγούμενο όριο.
Αυτός ο χώρος επιτρέπει στην τεχνητή νοημοσύνη να σκέφτεται σε βάθος. Σχεδιάζει, εκτελεί και διορθώνει τα λάθη της αυτόνομα, λύνοντας δύσκολα προβλήματα από την αρχή μέχρι το τέλος.

Πρωταθλητής σε προγραμματισμό, οικονομικά και νομικά
Το Argon καταγράφει κορυφαίες επιδόσεις σε εξειδικευμένα τεστ αξιολόγησης. Στο σημείο αναφοράς DeepSWE v1.1, που μετρά την αποτελεσματικότητα σε πραγματικές εργασίες προγραμματισμού, σκοράρει 77.9%.
Παράλληλα, καταλαμβάνει την πρώτη θέση στον δείκτη Vals Index, ο οποίος αξιολογεί την οικονομική επίδραση της τεχνητής νοημοσύνης σε τομείς όπως τα οικονομικά, τα νομικά και η φορολογία. Στο AutomationBench της Zapier, το οποίο μετρά την αυτοματοποίηση επιχειρηματικών διαδικασιών, το Argon βγήκε πρώτο με σκορ 51.3%.
Διακρίνεται επίσης στην κατανόηση εικόνας και βίντεο. Στο LVBench, ένα τεστ που αξιολογεί την ανάλυση βίντεο μεγάλης διάρκειας, πέτυχε εντυπωσιακή βαθμολογία 91.7%.
Ηγετικός ρόλος
στην αμυντική κυβερνοασφάλεια
Η Google εκπαίδευσε το Argon ώστε να εντοπίζει, να επαληθεύει και να διορθώνει αυτόνομα κρίσιμα κενά ασφαλείας σε λογισμικό. Η εταιρεία θα προσφέρει ειδικές εκδόσεις χωρίς περιορισμούς ασφαλείας σε πιστοποιημένους αμυντικούς αναλυτές, ώστε να αξιοποιήσουν πλήρως τις δυνατότητές του.
Η εταιρεία κυβερνοασφάλειας Wiz χρησιμοποιεί ήδη το Argon στην πρωτοβουλία Scan for Good. Σε μια από τις πρώτες δοκιμές, το μοντέλο ανακάλυψε μια σοβαρή ευπάθεια σε λογισμικό υγείας που χρησιμοποιείται σε νοσοκομεία παγκοσμίως, εκθέτοντας ευαίσθητα προσωπικά δεδομένα. Πρόκειται για ένα κενό που όλα τα προηγούμενα μοντέλα είχαν προσπεράσει.
Στο τεστ CWE-bench v1, το Argon ισοφάρισε στην πρώτη θέση με σκορ 68% στη διόρθωση ευπαθειών. Παράλληλα, σε εσωτερικές δοκιμές διείσδυσης της Wiz, ξεπέρασε τις προηγούμενες γενιές στον εντοπισμό ευπαθειών σε ζωντανές εφαρμογές ιστού.
Αυστηρά μέτρα προστασίας
πριν τη δημόσια κυκλοφορία
Πριν το μοντέλο γίνει διαθέσιμο σε όλους, η Google ενισχύει τις δικλίδες ασφαλείας σε τέσσερις βασικούς άξονες:
Αποτροπή κακόβουλης χρήσης: Το Argon απορρίπτει αιτήματα για κυβερνοεπιθέσεις ή δημιουργία χημικών και βιολογικών απειλών, ενώ επιτρέπει τη νόμιμη επιστημονική έρευνα.
Άμυνα σε επιθέσεις Prompt Injection: Εκπαιδεύτηκε ώστε να μην παρασύρεται από κακόβουλες οδηγίες που κρύβονται μέσα σε εξωτερικά δεδομένα.
Παρακολούθηση ευθυγράμμισης: Ειδικά συστήματα παρακολουθούν τις εσωτερικές σκέψεις του μοντέλου την ώρα που εργάζεται. Αν διαπιστώσουν ότι ξεφεύγει από τις προθέσεις του χρήστη, διακόπτουν αμέσως την εκτέλεση.
Θωράκιση υποδομών: Οι δοκιμές γίνονται σε απομονωμένα, σφραγισμένα περιβάλλοντα (sandboxes) για την αποφυγή διαρροών ή ανεξέλεγκτων ενεργειών.
Πότε θα είναι διαθέσιμο
Το Gemini 4 Argon αποτελεί έναν ισχυρό συνεργάτη για προγραμματιστές και επιχειρήσεις. Μετά την ολοκλήρωση των αρχικών δοκιμών με την κοινότητα ασφαλείας, η Google θα διαθέσει το μοντέλο στους πελάτες της πληρωμένης υπηρεσίας API, καθώς και στους συνδρομητές του πακέτου Google AI Ultra.
