- Δείκτης
- Artificial Analysis Intelligence Index: συνολική βαθμολογία 0–100 από δεκάδες τεστ (λογική, γνώσεις, μαθηματικά, προγραμματισμός, χρήση εργαλείων). Όσο μεγαλύτερος, τόσο πιο ικανό το μοντέλο.
- Coding
- Terminal-Bench 4.0 (μέτρηση της Artificial Analysis): το μοντέλο δουλεύει σαν προγραμματιστής μέσα σε τερματικό υπολογιστή και πρέπει να ολοκληρώσει μόνο του πραγματικές εργασίες, π.χ. να διορθώσει κώδικα ή να στήσει ένα πρόγραμμα. Το ποσοστό δείχνει πόσες εργασίες ολοκλήρωσε επιτυχώς.
- Ταχύτητα
- Πόσα tokens (κομμάτια λέξεων) γράφει το μοντέλο ανά δευτερόλεπτο μέσω API, διάμεση τιμή. Η παύλα σημαίνει ότι δεν έχει μετρηθεί ακόμη.
- Τιμή
- Κόστος χρήσης μέσω API σε δολάρια ανά 1 εκατομμύριο tokens: «in» για ό,τι στέλνετε στο μοντέλο, «out» για την απάντηση που γράφει. 1M tokens είναι περίπου 750.000 αγγλικές λέξεις.
- (max), (xhigh)…
- Το επίπεδο «σκέψης» (reasoning effort) με το οποίο μετρήθηκε το μοντέλο. Περισσότερη σκέψη δίνει συνήθως καλύτερα αποτελέσματα, αλλά πιο αργά και ακριβότερα.
- Open weights
- Τα «βάρη» του μοντέλου διατίθενται δημόσια, οπότε μπορεί να εγκατασταθεί και να τρέξει σε δικούς σας υπολογιστές.