Claude Sonnet 5.5: επιδόσεις σχεδόν όσο το Opus 5.5 με τη μισή τιμή

Η Anthropic κυκλοφόρησε το Claude Sonnet 5.5: 56 μονάδες στον δείκτη της Artificial Analysis, δεύτερο μόνο πίσω από το Opus 5.5, με τη μισή τιμή. Επιδόσεις, τιμές και σύγκριση με τα GPT-6.

Το λογότυπο της Anthropic, της εταιρείας που κυκλοφόρησε το Claude Sonnet 5.5
Εικόνα: Anthropic

Με μια ματιά

  • Το Claude Sonnet 5.5 είναι πάνω από 30% πιο γρήγορο από το Sonnet 5 και κοστίζει έως 30% λιγότερο ανά εργασία.
  • Στον Intelligence Index της Artificial Analysis πήρε 56, δεύτερο μόνο πίσω από το Opus 5.5 (58)· στο Terminal-Bench είναι πρώτο.
  • Η τιμή μένει 2/10 δολάρια ανά εκατομμύριο tokens· το Haiku 5.5 έρχεται τις επόμενες εβδομάδες.

Η Anthropic κυκλοφόρησε σήμερα, 28 Σεπτεμβρίου, το Claude Sonnet 5.5, τη νέα έκδοση του «καθημερινού» μοντέλου της. Έρχεται μόλις έξι ημέρες μετά το Claude Opus 5.5, με το οποίο μοιράζεται την ίδια βάση. Επομένως, σε πολλά τεστ φτάνει πολύ κοντά στο ακριβότερο Opus, με την τιμή ενός Sonnet.

Σύμφωνα με την ανακοίνωση της Anthropic, το νέο μοντέλο γράφει απαντήσεις πάνω από 30% πιο γρήγορα από το Sonnet 5. Επίσης, χρειάζεται λιγότερα tokens και λιγότερες κλήσεις εργαλείων, έτσι μια εργασία κοστίζει έως 30% λιγότερο.

Οι επιδόσεις του Claude Sonnet 5.5

Η Anthropic δημοσίευσε σύγκριση με το Sonnet 5, το Opus 5.5 και το GPT-6 Sol. Με έντονα γράμματα σημειώνουμε την καλύτερη επίδοση σε κάθε τεστ:

ΤεστSonnet 5.5Opus 5.5Sonnet 5GPT-6 Sol
Terminal-Bench 4.0 (προγραμματισμός με agents)70,6%66,4%10,3%—
OSWorld 2.1 (χρήση υπολογιστή)80,1%81,8%57,0%—
CursorBench 4.055,5%57,8%34,1%—
FrontierCode 1.146,2%54,4%42,4%49,3%
Humanity’s Last Exam64,5%67,7%54,9%—
GDPval-AA (επαγγελματικές εργασίες)1.8441.8461.4491.487
AA-Briefcase1.8111.8221.3591.483
Chartography (διαγράμματα)61,6%64,4%15,6%53,6%
Πηγή: Anthropic. Η Anthropic δεν έδωσε αποτελέσματα για το Claude Fable 5.1 και το GPT-6 Astra.

Με άλλα λόγια, το Sonnet 5.5 ξεπερνά το Opus 5.5 στο Terminal-Bench και μένει λίγες μονάδες πίσω στα υπόλοιπα. Το GDPval-AA και το AA-Briefcase είναι τεστ της ανεξάρτητης Artificial Analysis· εκεί, το Sonnet 5.5 φτάνει σχεδόν το Opus 5.5 και αφήνει πολύ πίσω το GPT-6 Sol. Μάλιστα, σύμφωνα με το SiliconANGLE, είναι το πρώτο Sonnet που τερμάτισε το Pokémon Red μόνο με στιγμιότυπα οθόνης.

Τι λένε τα τεστ της Artificial Analysis

Η ανεξάρτητη Artificial Analysis έβγαλε τα δικά της αποτελέσματα. Στον γενικό της δείκτη, τον Intelligence Index, το Sonnet 5.5 πήρε 56 μονάδες, 18 περισσότερες από το Sonnet 5. Έτσι, είναι δεύτερο στη λίστα, μόλις δύο μονάδες πίσω από το Opus 5.5 και τρεις μπροστά από το GPT-6 Astra.

ΜοντέλοIntelligence IndexTerminal-Bench 4.0
Claude Sonnet 5.55664%
Claude Opus 5.55860%
Claude Fable 5.15352%
GPT-6 Astra5359%
GPT-6 Sol4844%
Claude Sonnet 538—
Πηγή: Artificial Analysis, 28 Σεπτεμβρίου 2026, στο μέγιστο επίπεδο σκέψης κάθε μοντέλου. Το Terminal-Bench εδώ είναι η δική της μέτρηση.

Επιπλέον, στο Terminal-Bench 4.0 της Artificial Analysis το Sonnet 5.5 έχει την καλύτερη επίδοση από όλα τα μοντέλα, με 64%. Στο AutomationBench-AA ξεπερνά οριακά το Opus 5.5 (71% έναντι 70%). Ακόμη, κάνει λιγότερα λάθη «από φαντασία»: το ποσοστό ψευδών απαντήσεων (hallucinations) είναι 47%, έναντι 59% για το Opus 5.5.

Ωστόσο, υπάρχει ένα κόστος. Στο μέγιστο επίπεδο σκέψης, το Sonnet 5.5 γράφει περίπου 193.000 tokens ανά εργασία, τα περισσότερα που έχει μετρήσει η Artificial Analysis. Έτσι, το κόστος ανά εργασία φτάνει περίπου τα 7,60 δολάρια, 50% πάνω από το Sonnet 5. Αυτό δεν συμφωνεί με το «έως 30% φθηνότερο» της Anthropic· ίσως η διαφορά έχει να κάνει με το μέγιστο επίπεδο σκέψης που χρησιμοποιεί η Artificial Analysis. Επίσης, στις γενικές γνώσεις (AA-Omniscience) μένει πίσω από το Opus 5.5, με 54% έναντι 66%. Όλα τα μοντέλα θα τα βρείτε στον πίνακα των μοντέλων.

Τιμή και διαθεσιμότητα του Claude Sonnet 5.5

Το Sonnet 5.5 κρατά την τιμή του Sonnet 5. Έτσι, κοστίζει όσο το GPT-6 Sol και τη μισή τιμή από το Opus 5.5:

ΜοντέλοΕίσοδοςΈξοδοςΣε σχέση με το Sonnet 5.5
Claude Sonnet 5.52 $10 $βάση σύγκρισης
GPT-6 Sol2 $10 $ίδια τιμή
Claude Opus 5.54 $20 $2 φορές ακριβότερο
Claude Fable 5.110 $50 $5 φορές ακριβότερο
GPT-6 Astra10 $50 $5 φορές ακριβότερο
Τιμές API σε δολάρια ανά 1 εκατομμύριο tokens. Πηγές: Anthropic, Artificial Analysis.
  • Πού θα το βρείτε: στην εφαρμογή Claude, στο Claude Code, στο API και στα cloud της Amazon, της Google και της Microsoft·
  • Όνομα στο API: claude-sonnet-5-5.

Επίσης, οι πρώτοι πελάτες αναφέρουν καλά αποτελέσματα. Για παράδειγμα, η Zendesk λέει ότι επεξεργάζεται τα αιτήματα πελατών 20% πιο γρήγορα. Η Box, από την πλευρά της, μέτρησε 2,4 φορές μεγαλύτερη ταχύτητα και 12% λιγότερα tokens, σύμφωνα με το VentureBeat.

Ασφάλεια και επόμενα βήματα

Είναι το πρώτο Sonnet με σημαντικές ικανότητες στην κυβερνοασφάλεια, κοντά στο Opus 5.5. Γι’ αυτό, η Anthropic ελέγχει σε πραγματικό χρόνο τα επικίνδυνα αιτήματα και τα στέλνει στο παλαιότερο Sonnet 5. Ακόμη, είναι το πρώτο Sonnet με φίλτρα που εμποδίζουν την «αντιγραφή» του τρόπου σκέψης του από ανταγωνιστές.

Τέλος, η Anthropic ετοιμάζει και το Haiku 5.5, το πιο μικρό και φθηνό μοντέλο της, για τις επόμενες εβδομάδες. Περισσότερα για τα νέα μοντέλα θα βρείτε στην ενότητα Μοντέλα AI.

Πηγές:

Συντάκτης: Κλαύδιος