HomeBody: ανθρωποειδές ρομπότ με «εγκέφαλο» το GPT-6 τακτοποιεί άγνωστες κουζίνες

Stanford και Caltech σύνδεσαν το GPT-6 Astra με ένα ρομπότ Unitree G1. Το HomeBody εξερευνά μια άγνωστη κουζίνα, θυμάται πού είναι τα πράγματα και κάνει δουλειές χωρίς επιπλέον εκπαίδευση.

Το ανθρωποειδές ρομπότ Unitree G1 σε πάγκο με τηγάνι, πιάτο και αυγά
Το ανθρωποειδές ρομπότ Unitree G1, το ίδιο μοντέλο που χρησιμοποιεί το HomeBody. Εικόνα: Unitree

Με μια ματιά

  • Stanford και Caltech σύνδεσαν απευθείας το GPT-6 Astra με ένα ανθρωποειδές Unitree G1, χωρίς το συνηθισμένο μοντέλο VLA.
  • Το ρομπότ φτιάχνει «ψηφιακό δίδυμο» της κουζίνας, θυμάται αντικείμενα και διαλέγει ανάμεσα σε πέντε βασικές κινήσεις.
  • Όρια: παύσεις λόγω καθυστέρησης, κόστος API και υπερθέρμανση στα δάχτυλα.

Ερευνητές από το Stanford και το Caltech έβαλαν το GPT-6 Astra της OpenAI να «οδηγεί» ένα ανθρωποειδές ρομπότ. Το όνομα του συστήματος είναι HomeBody. Το ρομπότ εξερευνά μια άγνωστη κουζίνα, κρατά στη μνήμη πού είναι τα πράγματα και μετά κάνει δουλειές μόνο του, όπως να τακτοποιήσει τον χώρο.

Το ρομπότ είναι ένα Unitree G1, από τα πιο γνωστά κινεζικά ανθρωποειδή. Την έρευνα υπογράφουν οι Gio Huh (Caltech), Cayden Gu, Takara E. Truong, C. Karen Liu και Guy Tevet από το Movement Lab του Stanford, σύμφωνα με τη σελίδα του έργου.

Πώς δουλεύει το HomeBody

Αρχικά, το ρομπότ γυρίζει στον χώρο και φτιάχνει έναν «ψηφιακό δίδυμο» της κουζίνας στο Isaac Sim της Nvidia. Έτσι, έχει έναν τρισδιάστατο χάρτη και κρατά στη μνήμη αντικείμενα ακόμη και όταν δεν τα βλέπει. Στη συνέχεια, το GPT-6 Astra αποφασίζει τι θα κάνει, διαλέγοντας ανάμεσα σε πέντε βασικές κινήσεις:

  • να πάει σε ένα σημείο·
  • να πιάσει ένα αντικείμενο·
  • να το αφήσει κάπου·
  • να ανοίξει ένα συρτάρι·
  • να πάρει κάτι από ένα συρτάρι.

Για παράδειγμα, στις δοκιμές το ρομπότ μάζεψε σακουλάκια καφέ και πέταξε χαλασμένα γαλακτοκομικά. Επίσης, βρήκε σε ένα κλειστό συρτάρι ένα φάρμακο που είχε δει νωρίτερα.

Γιατί το HomeBody είναι διαφορετικό

Συνήθως, ανάμεσα στο γλωσσικό μοντέλο και στο ρομπότ υπάρχει ένα ειδικό μοντέλο ελέγχου, το VLA (Vision-Language-Action). Αυτό χρειάζεται εκπαίδευση για κάθε νέο χώρο και κάθε νέα δουλειά. Αντίθετα, το HomeBody δεν έχει VLA: το GPT-6 Astra καλεί απευθείας τις κινήσεις του ρομπότ, σαν εργαλεία.

Με άλλα λόγια, το ρομπότ δουλεύει σε άγνωστο χώρο χωρίς επιπλέον εκπαίδευση, σύμφωνα με το AI Weekly. Μάλιστα, το «μυαλό» μπορεί να αλλάξει: το σύστημα δέχεται και άλλα μοντέλα στη θέση του GPT-6 Astra.

Τα όρια του ρομπότ

Ωστόσο, το σύστημα απέχει ακόμη πολύ από το σπίτι μας. Οι ίδιοι οι ερευνητές σημειώνουν ότι:

  • το GPT-6 Astra τρέχει στο cloud και σκέφτεται αργά, έτσι το ρομπότ κάνει παύσεις ανάμεσα στις κινήσεις·
  • ο «ψηφιακός δίδυμος» θέλει χρόνο για το στήσιμο και ανεβάζει το κόστος σε API·
  • τα μοτέρ στα δάχτυλα παθαίνουν υπερθέρμανση όταν το ρομπότ δουλεύει ώρες·
  • ένα laptop με κάρτα γραφικών RTX 4090 τρέχει τον έλεγχο των κινήσεων.

Επιπλέον, σύμφωνα με το The Decoder, άλλα τεστ έχουν δείξει ότι το Astra μπορεί να κάνει επικίνδυνες κινήσεις όταν ελέγχει ρομποτικούς βραχίονες. Εξάλλου, η ασφάλεια των agents απασχολεί πολύ τις εταιρείες. Για παράδειγμα, η OpenAI σταμάτησε πρόσφατα τα πιο ισχυρά μοντέλα της. Περισσότερα θα βρείτε στην ενότητα Ρομποτική & Agents.

Πηγές:

Συντάκτης: Κλαύδιος