GPT-6.1 Sol: σχεδόν όσο το GPT-6 Astra, στην τιμή του Claude Sonnet 5.5

Η OpenAI κυκλοφόρησε το GPT-6.1 Sol: 52 μονάδες στον δείκτη της Artificial Analysis, μία κάτω από το Astra, με το ένα πέμπτο της τιμής. Κοστίζει όσο το Claude Sonnet 5.5, αλλά μια εργασία του βγαίνει δέκα φορές φθηνότερη.

Κάρτες της OpenAI για τα GPT-6 Astra, GPT-6.1 Sol και GPT-6 Luna με τις τιμές ανά εκατομμύριο tokens
Τα τρία μοντέλα της OpenAI μετά το DevDay, με τις τιμές τους. Εικόνα: OpenAI

Με μια ματιά

  • Το GPT-6.1 Sol πήρε 52 μονάδες στον Intelligence Index της Artificial Analysis, μία κάτω από το GPT-6 Astra και τέσσερις πάνω από το GPT-6 Sol.
  • Κοστίζει 2/10 δολάρια ανά εκατομμύριο tokens, όσο το Claude Sonnet 5.5 και το ένα πέμπτο του Astra· στα τεστ της AA μια εργασία κοστίζει 0,72 δολάρια.
  • Διατίθεται στο ChatGPT Work, στο Codex και στο API (gpt-6.1-sol), όχι ακόμη στην κανονική συνομιλία του ChatGPT.

Η OpenAI παρουσίασε στο DevDay, στις 29 Σεπτεμβρίου, το GPT-6.1 Sol. Είναι αναβάθμιση του GPT-6 Sol, που κυκλοφόρησε μόλις μία εβδομάδα νωρίτερα. Σύμφωνα με την OpenAI, φτάνει σχεδόν το GPT-6 Astra, με το ένα πέμπτο της τιμής του.

Επιπλέον, κοστίζει ακριβώς όσο το Claude Sonnet 5.5 της Anthropic: 2 δολάρια για ένα εκατομμύριο tokens εισόδου και 10 για την έξοδο. Ωστόσο, στα τεστ της ανεξάρτητης Artificial Analysis, μια εργασία με το GPT-6.1 Sol κοστίζει περίπου δέκα φορές λιγότερο.

Οι επιδόσεις του GPT-6.1 Sol

Η OpenAI δημοσίευσε σύγκριση με το GPT-6 Astra, το GPT-6 Sol και το Claude Opus 5.5. Η OpenAI δοκίμασε κάθε μοντέλο σε πέντε επίπεδα σκέψης (reasoning effort). Εμείς κρατάμε την καλύτερη επίδοση του καθενός, και με έντονα γράμματα σημειώνουμε την καλύτερη σε κάθε τεστ:

ΤεστGPT-6.1 SolGPT-6 AstraOpus 5.5GPT-6 Sol
OSWorld 2.0 (χρήση υπολογιστή)71,4%73,5%—64,4%
GDP.pdf (ερωτήσεις σε έγγραφα PDF)32,0%32,2%28,8%28,0%
AutomationBench (επιχειρηματικές εργασίες)36,1%41,4%42,5%33,2%
Terminal-Bench Science 0.1 (επιστημονική έρευνα)57,0%68,1%63,3%27,6%
Πηγή: OpenAI. Καλύτερη επίδοση κάθε μοντέλου σε οποιοδήποτε επίπεδο σκέψης. Το Opus 5.5 με εφεδρικά μοντέλα (fallbacks), όπως το μέτρησε η OpenAI.

Με άλλα λόγια, το νέο Sol δεν ξεπερνά το Astra σε κανένα από αυτά τα τεστ, αλλά φτάνει πολύ κοντά. Επίσης, στο DeepSWE, ένα δύσκολο τεστ προγραμματισμού, η OpenAI λέει ότι φτάνει το Astra, με 75,2%. Όμως, υπάρχει μια λεπτομέρεια. Η OpenAI γράφει ότι στο AutomationBench ξεπερνά το Opus 5.5 κατά 2,2 μονάδες. Αυτό ισχύει στο μεσαίο επίπεδο σκέψης (31,7% έναντι 29,5%). Στο μέγιστο, αντίθετα, το Opus 5.5 περνά μπροστά με 42,5%.

Το μεγάλο του πλεονέκτημα είναι το κόστος. Για παράδειγμα, στο Terminal-Bench Science μια εργασία κοστίζει κατά μέσο όρο 5,47 δολάρια, έναντι 23,21 για το Opus 5.5 και 23,80 για το Astra. Ακόμη, στο OSWorld κοστίζει 1,27 δολάρια ανά εργασία, ενώ το Astra θέλει 9,44.

Τι λένε τα τεστ της Artificial Analysis

Η Artificial Analysis έδωσε στο GPT-6.1 Sol 52 μονάδες στον γενικό της δείκτη, τον Intelligence Index. Έτσι, μένει μόλις μία μονάδα πίσω από το Astra και τέσσερις μπροστά από το GPT-6 Sol. Επιπλέον, στο Terminal-Bench 4.0 ανέβηκε κατά 12 μονάδες.

ΜοντέλοIntelligence IndexTerminal-Bench 4.0Κόστος ανά εργασία
GPT-6.1 Sol52≈56%0,72 $
Claude Opus 5.55860%5,98 $
Claude Sonnet 5.55664%7,60 $
GPT-6 Astra5359%3,26 $
Claude Fable 5.15352%7,63 $
GPT-6 Sol4844%1,05 $
Πηγή: Artificial Analysis, 30 Σεπτεμβρίου 2026, στο μέγιστο επίπεδο σκέψης. Κόστος: μέσο κόστος ανά εργασία του Intelligence Index. Για το GPT-6.1 Sol, η Artificial Analysis ανέφερε άνοδο 12 μονάδων στο Terminal-Bench, από το 44% του GPT-6 Sol.

Η τελευταία στήλη εξηγεί το ενδιαφέρον. Το GPT-6.1 Sol και το Sonnet 5.5 έχουν την ίδια τιμή ανά token, όμως το Sonnet 5.5 γράφει πολύ περισσότερα tokens σε κάθε εργασία. Έτσι, στα τεστ της Artificial Analysis κάθε εργασία του Sonnet κοστίζει περίπου δέκα φορές περισσότερο. Από την άλλη, το Sonnet 5.5 έχει καλύτερη βαθμολογία, 56 έναντι 52, και είναι καλύτερο στον προγραμματισμό.

Ακόμη, το GPT-6.1 Sol κάνει λιγότερα λάθη «από φαντασία»: το ποσοστό ψευδών απαντήσεων (hallucinations) έπεσε από 60% σε 54%. Παρ’ όλα αυτά, μένει πίσω από το Sonnet 5.5, που έχει 47%. Όλα τα μοντέλα θα τα βρείτε στον πίνακα των μοντέλων.

Τιμή και διαθεσιμότητα του GPT-6.1 Sol

Το GPT-6.1 Sol κρατά την τιμή του GPT-6 Sol. Επομένως, κοστίζει όσο το Sonnet 5.5, το μισό από το Opus 5.5 και το ένα πέμπτο από το Astra:

ΜοντέλοΕίσοδοςΈξοδοςΣε σχέση με το GPT-6.1 Sol
GPT-6.1 Sol2 $10 $βάση σύγκρισης
Claude Sonnet 5.52 $10 $ίδια τιμή
Claude Opus 5.54 $20 $2 φορές ακριβότερο
GPT-6 Astra10 $50 $5 φορές ακριβότερο
Claude Fable 5.110 $50 $5 φορές ακριβότερο
Τιμές API σε δολάρια ανά 1 εκατομμύριο tokens. Πηγές: OpenAI, Artificial Analysis.
  • Αποθηκευμένη είσοδος (cache): 0,10 δολάρια ανά εκατομμύριο tokens, δηλαδή 95% φθηνότερα από την κανονική είσοδο και τα μισά από το GPT-6 Sol·
  • Μεγάλα κείμενα: πάνω από 272.000 tokens εισόδου, η είσοδος κοστίζει διπλάσια και η έξοδος 1,5 φορά, σύμφωνα με το WinBuzzer·
  • Μέγεθος: έως 1,05 εκατομμύρια tokens εισόδου και έως 128.000 tokens εξόδου·
  • Πού θα το βρείτε: στο ChatGPT Work και στο Codex, για συνδρομητές Plus, Pro, Business, Enterprise και Edu· ακόμη δεν υπάρχει στην κανονική συνομιλία (Chat)·
  • Όνομα στο API: gpt-6.1-sol.

Επίσης, τις επόμενες μέρες η OpenAI ετοιμάζει και το GPT-6.1 Sol Ultrafast, που γράφει έως οκτώ φορές πιο γρήγορα μέσα στο Codex.

Ασφάλεια: ένα βήμα πιο κοντά στο Astra

Η κυκλοφορία συμπίπτει με δύσκολες μέρες για την OpenAI, που πάγωσε πρόσφατα τα πιο ισχυρά μοντέλα της μετά από ένα περιστατικό με AI agent. Σύμφωνα με την OpenAI, το GPT-6.1 Sol τα πηγαίνει καλύτερα από το GPT-6 Sol στους ελέγχους ασφαλείας και πλησιάζει το Astra.

Συγκεκριμένα, λέει πιο καθαρά τι δεν μπορεί να κάνει και σέβεται καλύτερα τους περιορισμούς του χρήστη. Επιπλέον, δεν έκανε καμία προσπάθεια να παρακάμψει τον αυτόματο ελεγκτή ασφαλείας. Τέλος, στις δύσκολες ερωτήσεις έκανε λιγότερα λάθη: στο χαμηλό επίπεδο σκέψης, οι απαντήσεις με λάθος έπεσαν από 11,4% σε 7,7%. Περισσότερα για τα νέα μοντέλα θα βρείτε στην ενότητα Μοντέλα AI.

Πηγές:

Συντάκτης: Κλαύδιος