Gemini 4: το πιο έξυπνο μοντέλο της Google έφτασε, αλλά δεν μπορείτε ακόμη να το χρησιμοποιήσετε

Η Google παρουσίασε το Gemini 4 Argon, το πιο έξυπνο μοντέλο της. Στα περισσότερα τεστ ξεπερνά τα κορυφαία μοντέλα της OpenAI και της Anthropic, όμως προς το παρόν το παίρνουν μόνο ειδικοί κυβερνοασφάλειας.

Η εικόνα της Google για το Gemini 4 Argon, με το λογότυπο του Gemini και έναν μεγάλο αριθμό 4
Εικόνα: Google

Με μια ματιά

  • Είναι το πιο ικανό μοντέλο της Google και στα περισσότερα τεστ ξεπερνά τα κορυφαία μοντέλα πίσω από το ChatGPT και το Claude· χάνει σε ορισμένα τεστ προγραμματισμού και επιστήμης.
  • Δεν μπορείτε να το χρησιμοποιήσετε ακόμη· πρώτα το παίρνουν ειδικοί κυβερνοασφάλειας.
  • Μετά θα έρθει στους συνδρομητές του Google AI Ultra και στους προγραμματιστές, χωρίς ημερομηνία ακόμη.

Η Google παρουσίασε στις 30 Σεπτεμβρίου το Gemini 4 Argon, το πιο έξυπνο μοντέλο τεχνητής νοημοσύνης που έχει φτιάξει μέχρι σήμερα. Σύμφωνα με τα δικά της τεστ, ξεπερνά το GPT-6 Astra, το πιο ισχυρό μοντέλο πίσω από το ChatGPT, και το Claude Opus 5.5 της Anthropic σε 12 από τα 18 τεστ. Ωστόσο, προς το παρόν δεν μπορείτε να το δοκιμάσετε: η Google το δίνει πρώτα μόνο σε λίγους ειδικούς της κυβερνοασφάλειας.

Επιπλέον, μπορεί να γράψει πολύ μεγαλύτερες απαντήσεις: έως 1 εκατομμύριο tokens (κομμάτια λέξεων) τη φορά, ενώ τα προηγούμενα Gemini σταματούσαν στις 64.000. Έτσι, έχει χώρο να «σκεφτεί» για ώρα και να λύσει μεγάλα προβλήματα με μία προσπάθεια.

Πού ξεχωρίζει το νέο μοντέλο της Google

Η Google DeepMind δημοσίευσε σύγκριση σε 18 τεστ με το GPT-6 Astra, το Claude Opus 5.5 και το Claude Fable 5.1. Παρακάτω είναι οκτώ από αυτά, και με έντονα γράμματα σημειώνουμε την καλύτερη επίδοση σε κάθε τεστ:

ΤεστGemini 4 ArgonGPT-6 AstraOpus 5.5Fable 5.1
Harvey Legal Agent (νομική έρευνα)19,6%5,4%3,8%6,7%
Vals Finance Agent v2 (οικονομικά)65,4%53,5%58,6%58,9%
AutomationBench (εργασίες γραφείου)51,3%41,4%42,5%31,4%
DeepSWE v1.1 (προγραμματισμός)77,9%74,1%74,2%67,4%
Terminal-Bench 4.0 (προγραμματισμός)57,4%58,2%66,4%57,9%
Terminal-Bench Science 0.1 (επιστήμη)57,6%68,1%63,3%52,6%
LVBench (κατανόηση μεγάλων βίντεο)91,7%87,5%83,7%79,7%
CWE-bench v1 (διόρθωση κενών ασφαλείας)68,0%68,0%67,0%58,0%
Πηγή: Google DeepMind. Όλα τα 18 τεστ θα τα βρείτε στη σελίδα της Google DeepMind.

Με άλλα λόγια, το Argon κερδίζει καθαρά στην «επαγγελματική» δουλειά. Για παράδειγμα, στο τεστ νομικής έρευνας της Harvey πετυχαίνει 19,6%, όταν τα άλλα μοντέλα μένουν κάτω από 7%. Επίσης, προηγείται στα οικονομικά και στην κατανόηση μεγάλων βίντεο. Αντίθετα, στον προγραμματισμό η εικόνα είναι μοιρασμένη: στο DeepSWE, το μεγαλύτερο τεστ προγραμματισμού της λίστας, είναι πρώτο, όμως στο Terminal-Bench 4.0 το Opus 5.5 περνά μπροστά κατά εννέα μονάδες. Ακόμη, στα επιστημονικά τεστ το GPT-6 Astra μένει μπροστά.

Παράλληλα, η Google δίνει παραδείγματα από τη δική της δουλειά. Μια ομάδα από AI agents, δηλαδή προγράμματα AI που δουλεύουν μόνα τους, βρήκε βελτιώσεις στα data centers της εταιρείας και ελευθέρωσε τεράστιο όγκο μνήμης. Επιπλέον, οι agents του Argon ξαναγράφουν παλιό κώδικα της Google σε πιο ασφαλή γλώσσα προγραμματισμού, ακόμη και 800.000 γραμμές σε ένα λειτουργικό σύστημα της εταιρείας.

Τι λένε τα τεστ της Artificial Analysis

Η Artificial Analysis είναι ανεξάρτητη εταιρεία που βαθμολογεί τα μοντέλα AI με τα ίδια τεστ για όλα. Έδωσε στο Gemini 4 Argon 53 μονάδες στον γενικό της δείκτη (Intelligence Index), όσες και στο GPT-6 Astra. Έτσι, η Google ξαναμπαίνει στα τρία πρώτα εργαστήρια AI. Για σύγκριση, το προηγούμενο μεγάλο μοντέλο της, το Gemini 3.1 Pro Preview, είχε 30 μονάδες.

ΜοντέλοIntelligence IndexTerminal-Bench 4.0Κόστος ανά δοκιμή
Gemini 4 Argon5357%1,99 $
Claude Opus 5.55860%5,98 $
Claude Sonnet 5.55664%7,62 $
GPT-6 Astra5359%3,26 $
Claude Fable 5.15352%7,63 $
GPT-6.1 Sol5256%0,72 $
Gemini 3.8 Flash4120%1,24 $
Πηγή: Artificial Analysis, 1 Οκτωβρίου 2026, στο μέγιστο επίπεδο σκέψης κάθε μοντέλου (για το Argon, το «high»). Κόστος: πόσο κόστισε κατά μέσο όρο κάθε δοκιμή του Intelligence Index. Το Terminal-Bench 4.0 εδώ είναι η δική της μέτρηση· η Google μετρά αλλιώς, γι’ αυτό τα ποσοστά διαφέρουν από τον πρώτο πίνακα.

Η τελευταία στήλη δείχνει πόσο κόστισε στην Artificial Analysis να λύσει κάθε μοντέλο μία δοκιμή. Προς το παρόν, το Argon κοστίζει 1,99 δολάρια ανά δοκιμή, δηλαδή περίπου 60% του Astra. Όμως, αυτό ισχύει με την εισαγωγική τιμή. Όταν λήξει η έκπτωση, το κόστος θα ανέβει στα 3,98 δολάρια, περίπου 1,2 φορές πάνω από το Astra. Επίσης, στο Terminal-Bench 4.0 της Artificial Analysis η διαφορά από το Opus 5.5 είναι μικρότερη από ό,τι στα τεστ της Google. Όλα τα μοντέλα θα τα βρείτε στον πίνακα των μοντέλων.

Γιατί το Gemini 4 Argon πάει πρώτα στην κυβερνοασφάλεια

Η Google εκπαίδευσε το Argon ειδικά για την άμυνα στο διαδίκτυο. Σύμφωνα με την ανακοίνωση, μπορεί να βρει, να επιβεβαιώσει και να διορθώσει μόνο του σοβαρά κενά ασφαλείας σε λογισμικό. Γι’ αυτό, το δίνει πρώτα σε έμπιστους ειδικούς κυβερνοασφάλειας, μέσα από το πρόγραμμα Fairwind. Μάλιστα, σε αυτούς το δίνει χωρίς τα φίλτρα που κανονικά μπλοκάρουν ερωτήσεις για επιθέσεις, ώστε να μπορούν να ελέγχουν σε βάθος τα δικά τους συστήματα.

Για παράδειγμα, η εταιρεία ασφαλείας Wiz το χρησιμοποιεί ήδη. Σύμφωνα με τη Google, το Argon εντόπισε ένα σοβαρό κενό σε λογισμικό που χρησιμοποιούν νοσοκομεία σε όλο τον κόσμο. Το κενό άφηνε εκτεθειμένα ευαίσθητα προσωπικά δεδομένα, και τα προηγούμενα μοντέλα δεν το είχαν βρει.

Επιπλέον, η Google συμμετέχει στη διαδικασία της αμερικανικής κυβέρνησης, που θέλει να βλέπει πρώτη τα νέα μοντέλα. Επίσης, λέει ότι παρακολουθεί τον τρόπο σκέψης και τις ενέργειες του Argon, ώστε να το σταματά όταν ξεφεύγει από όσα ζήτησε ο χρήστης. Τέλος, στο τεστ της Gray Swan για «κρυφές» εντολές (prompt injection), οι επιθέσεις πέτυχαν μόνο στο 0,7% των περιπτώσεων, έναντι 8,5% για το Astra, σύμφωνα με το VentureBeat.

Μπορώ να χρησιμοποιήσω το Gemini 4;

Όχι ακόμη. Η Google δεν έδωσε ημερομηνία για την ευρύτερη κυκλοφορία. Λέει μόνο ότι θα το ανοίξει «το συντομότερο δυνατό», με την εξής σειρά:

  • Τώρα: μόνο έμπιστοι ειδικοί κυβερνοασφάλειας, μέσα από το πρόγραμμα Fairwind·
  • Μετά: οι προγραμματιστές που πληρώνουν για το API και οι συνδρομητές του Google AI Ultra, της ακριβότερης συνδρομής της Google, που στις ΗΠΑ ξεκινά από περίπου 100 δολάρια τον μήνα·
  • Αργότερα: οι υπόλοιπες επιχειρήσεις και οι απλοί χρήστες.

Επομένως, όσοι χρησιμοποιούν το δωρεάν Gemini στο κινητό θα συνεχίσουν για λίγο ακόμη με τα τωρινά μοντέλα.

Πόσο θα κοστίζει το Gemini 4 στους προγραμματιστές

Για τους προγραμματιστές, το Argon θα έχει στην αρχή εισαγωγική τιμή, ίδια με το GPT-6.1 Sol της OpenAI. Αργότερα, η Google θα διπλασιάσει την τιμή, στο ύψος του Opus 5.5:

ΜοντέλοΕίσοδοςΈξοδοςΣε σχέση με το Argon (εισαγωγική τιμή)
Gemini 4 Argon (εισαγωγική τιμή)2 $10 $βάση σύγκρισης
Gemini 4 Argon (κανονική τιμή)4 $20 $2 φορές ακριβότερο
GPT-6.1 Sol2 $10 $ίδια τιμή
Claude Opus 5.54 $20 $2 φορές ακριβότερο
GPT-6 Astra10 $50 $5 φορές ακριβότερο
Claude Fable 5.110 $50 $5 φορές ακριβότερο
Τιμές API σε δολάρια ανά 1 εκατομμύριο tokens. Η αποθηκευμένη είσοδος (cache) του Argon κοστίζει 95% λιγότερο. Πηγές: Google, Artificial Analysis.

Περισσότερα για τα νέα μοντέλα θα βρείτε στην ενότητα Μοντέλα AI.

Πηγές:

Συντάκτης: Κλαύδιος