Claude Sonnet 5.5: επιδόσεις σχεδόν όσο το Opus 5.5 με τη μισή τιμή
Η Anthropic κυκλοφόρησε το Claude Sonnet 5.5: 56 μονάδες στον δείκτη της Artificial Analysis, δεύτερο μόνο πίσω από το Opus 5.5, με τη μισή τιμή. Επιδόσεις, τιμές και σύγκριση με τα GPT-6.
Με μια ματιά
- Το Claude Sonnet 5.5 είναι πάνω από 30% πιο γρήγορο από το Sonnet 5 και κοστίζει έως 30% λιγότερο ανά εργασία.
- Στον Intelligence Index της Artificial Analysis πήρε 56, δεύτερο μόνο πίσω από το Opus 5.5 (58)· στο Terminal-Bench είναι πρώτο.
- Η τιμή μένει 2/10 δολάρια ανά εκατομμύριο tokens· το Haiku 5.5 έρχεται τις επόμενες εβδομάδες.
Η Anthropic κυκλοφόρησε σήμερα, 28 Σεπτεμβρίου, το Claude Sonnet 5.5, τη νέα έκδοση του «καθημερινού» μοντέλου της. Έρχεται μόλις έξι ημέρες μετά το Claude Opus 5.5, με το οποίο μοιράζεται την ίδια βάση. Επομένως, σε πολλά τεστ φτάνει πολύ κοντά στο ακριβότερο Opus, με την τιμή ενός Sonnet.
Σύμφωνα με την ανακοίνωση της Anthropic, το νέο μοντέλο γράφει απαντήσεις πάνω από 30% πιο γρήγορα από το Sonnet 5. Επίσης, χρειάζεται λιγότερα tokens και λιγότερες κλήσεις εργαλείων, έτσι μια εργασία κοστίζει έως 30% λιγότερο.
Οι επιδόσεις του Claude Sonnet 5.5
Η Anthropic δημοσίευσε σύγκριση με το Sonnet 5, το Opus 5.5 και το GPT-6 Sol. Με έντονα γράμματα σημειώνουμε την καλύτερη επίδοση σε κάθε τεστ:
| Τεστ | Sonnet 5.5 | Opus 5.5 | Sonnet 5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 (προγραμματισμός με agents) | 70,6% | 66,4% | 10,3% | — |
| OSWorld 2.1 (χρήση υπολογιστή) | 80,1% | 81,8% | 57,0% | — |
| CursorBench 4.0 | 55,5% | 57,8% | 34,1% | — |
| FrontierCode 1.1 | 46,2% | 54,4% | 42,4% | 49,3% |
| Humanity’s Last Exam | 64,5% | 67,7% | 54,9% | — |
| GDPval-AA (επαγγελματικές εργασίες) | 1.844 | 1.846 | 1.449 | 1.487 |
| AA-Briefcase | 1.811 | 1.822 | 1.359 | 1.483 |
| Chartography (διαγράμματα) | 61,6% | 64,4% | 15,6% | 53,6% |
Με άλλα λόγια, το Sonnet 5.5 ξεπερνά το Opus 5.5 στο Terminal-Bench και μένει λίγες μονάδες πίσω στα υπόλοιπα. Το GDPval-AA και το AA-Briefcase είναι τεστ της ανεξάρτητης Artificial Analysis· εκεί, το Sonnet 5.5 φτάνει σχεδόν το Opus 5.5 και αφήνει πολύ πίσω το GPT-6 Sol. Μάλιστα, σύμφωνα με το SiliconANGLE, είναι το πρώτο Sonnet που τερμάτισε το Pokémon Red μόνο με στιγμιότυπα οθόνης.
Τι λένε τα τεστ της Artificial Analysis
Η ανεξάρτητη Artificial Analysis έβγαλε τα δικά της αποτελέσματα. Στον γενικό της δείκτη, τον Intelligence Index, το Sonnet 5.5 πήρε 56 μονάδες, 18 περισσότερες από το Sonnet 5. Έτσι, είναι δεύτερο στη λίστα, μόλις δύο μονάδες πίσω από το Opus 5.5 και τρεις μπροστά από το GPT-6 Astra.
| Μοντέλο | Intelligence Index | Terminal-Bench 4.0 |
|---|---|---|
| Claude Sonnet 5.5 | 56 | 64% |
| Claude Opus 5.5 | 58 | 60% |
| Claude Fable 5.1 | 53 | 52% |
| GPT-6 Astra | 53 | 59% |
| GPT-6 Sol | 48 | 44% |
| Claude Sonnet 5 | 38 | — |
Επιπλέον, στο Terminal-Bench 4.0 της Artificial Analysis το Sonnet 5.5 έχει την καλύτερη επίδοση από όλα τα μοντέλα, με 64%. Στο AutomationBench-AA ξεπερνά οριακά το Opus 5.5 (71% έναντι 70%). Ακόμη, κάνει λιγότερα λάθη «από φαντασία»: το ποσοστό ψευδών απαντήσεων (hallucinations) είναι 47%, έναντι 59% για το Opus 5.5.
Ωστόσο, υπάρχει ένα κόστος. Στο μέγιστο επίπεδο σκέψης, το Sonnet 5.5 γράφει περίπου 193.000 tokens ανά εργασία, τα περισσότερα που έχει μετρήσει η Artificial Analysis. Έτσι, το κόστος ανά εργασία φτάνει περίπου τα 7,60 δολάρια, 50% πάνω από το Sonnet 5. Αυτό δεν συμφωνεί με το «έως 30% φθηνότερο» της Anthropic· ίσως η διαφορά έχει να κάνει με το μέγιστο επίπεδο σκέψης που χρησιμοποιεί η Artificial Analysis. Επίσης, στις γενικές γνώσεις (AA-Omniscience) μένει πίσω από το Opus 5.5, με 54% έναντι 66%. Όλα τα μοντέλα θα τα βρείτε στον πίνακα των μοντέλων.
Τιμή και διαθεσιμότητα του Claude Sonnet 5.5
Το Sonnet 5.5 κρατά την τιμή του Sonnet 5. Έτσι, κοστίζει όσο το GPT-6 Sol και τη μισή τιμή από το Opus 5.5:
| Μοντέλο | Είσοδος | Έξοδος | Σε σχέση με το Sonnet 5.5 |
|---|---|---|---|
| Claude Sonnet 5.5 | 2 $ | 10 $ | βάση σύγκρισης |
| GPT-6 Sol | 2 $ | 10 $ | ίδια τιμή |
| Claude Opus 5.5 | 4 $ | 20 $ | 2 φορές ακριβότερο |
| Claude Fable 5.1 | 10 $ | 50 $ | 5 φορές ακριβότερο |
| GPT-6 Astra | 10 $ | 50 $ | 5 φορές ακριβότερο |
- Πού θα το βρείτε: στην εφαρμογή Claude, στο Claude Code, στο API και στα cloud της Amazon, της Google και της Microsoft·
- Όνομα στο API: claude-sonnet-5-5.
Επίσης, οι πρώτοι πελάτες αναφέρουν καλά αποτελέσματα. Για παράδειγμα, η Zendesk λέει ότι επεξεργάζεται τα αιτήματα πελατών 20% πιο γρήγορα. Η Box, από την πλευρά της, μέτρησε 2,4 φορές μεγαλύτερη ταχύτητα και 12% λιγότερα tokens, σύμφωνα με το VentureBeat.
Ασφάλεια και επόμενα βήματα
Είναι το πρώτο Sonnet με σημαντικές ικανότητες στην κυβερνοασφάλεια, κοντά στο Opus 5.5. Γι’ αυτό, η Anthropic ελέγχει σε πραγματικό χρόνο τα επικίνδυνα αιτήματα και τα στέλνει στο παλαιότερο Sonnet 5. Ακόμη, είναι το πρώτο Sonnet με φίλτρα που εμποδίζουν την «αντιγραφή» του τρόπου σκέψης του από ανταγωνιστές.
Τέλος, η Anthropic ετοιμάζει και το Haiku 5.5, το πιο μικρό και φθηνό μοντέλο της, για τις επόμενες εβδομάδες. Περισσότερα για τα νέα μοντέλα θα βρείτε στην ενότητα Μοντέλα AI.

