Artificial Intelligence 2 λεπτά ανάγνωσης

RLDX-1: Προηγμένη ρομποτική πολιτική για σύνθετη επιδέξια χειραγώγηση.

Παρόλο που τα μοντέλα Όρασης-Γλώσσας-Δράσης (VLAs) έχουν επιδείξει αξιοσημείωτη πρόοδο προς γενικευμένες ρομποτικές πολιτικές που προσομοιάζουν την ανθρώπινη συμπεριφορά, μέσω της ευέλικτης νοημοσύνης τους (δηλαδή, της ευρείας κατανόησης σκηνών και της γενίκευσης υπό συνθήκες γλώσσας) που κληρονομούν από προ-εκπαιδευμένα μοντέλα Όρασης-Γλώσσας, εξακολουθούν να αντιμετωπίζουν δυσκολίες σε σύνθετες εργασίες του πραγματικού κόσμου. Αυτές οι εργασίες απαιτούν ευρύτερες λειτουργικές δυνατότητες, όπως η επίγνωση κίνησης, η μακροπρόθεσμη μνήμη και η φυσική ανίχνευση.

Για την αντιμετώπιση αυτών των προκλήσεων, παρουσιάζεται το RLDX-1, μια ρομποτική πολιτική γενικού σκοπού σχεδιασμένη για επιδέξια χειραγώγηση. Το RLDX-1 βασίζεται στον Multi-Stream Action Transformer (MSAT), μια αρχιτεκτονική που ενοποιεί αυτές τις ειδικές ροές δυνατοτήτων με διατροπική κοινή αυτο-προσοχή. Επιπλέον, το RLDX-1 ενσωματώνει αυτή την αρχιτεκτονική με επιλογές σχεδιασμού σε επίπεδο συστήματος, οι οποίες περιλαμβάνουν τη σύνθεση δεδομένων για σπάνια σενάρια χειρισμού, διαδικασίες μάθησης εξειδικευμένες για ανθρώπινη χειραγώγηση και βελτιστοποιήσεις συμπερασμάτων για ανάπτυξη σε πραγματικό χρόνο.

Μέσω εμπειρικής αξιολόγησης, αποδεικνύεται ότι το RLDX-1 υπερέχει σταθερά έναντι πρόσφατων κορυφαίων VLAs (όπως τα $pi_{0.5}$ και GR00T N1.6), τόσο σε σημεία αναφοράς προσομοίωσης όσο και σε εργασίες του πραγματικού κόσμου που απαιτούν ευρείες λειτουργικές δυνατότητες πέρα από τη γενική ευελιξία. Ειδικότερα, το RLDX-1 επιδεικνύει ανωτερότητα στις εργασίες ανθρωποειδών ALLEX με ποσοστό 86,8%, ενώ τα $pi_{0.5}$ και GR00T N1.6 επιτυγχάνουν περίπου 40%. Αυτό υπογραμμίζει την ικανότητα του RLDX-1 να ελέγχει ένα ανθρωποειδές ρομπότ υψηλού βαθμού ελευθερίας (DoF) υπό ποικίλες λειτουργικές απαιτήσεις. Συνολικά, αυτά τα αποτελέσματα καθιστούν το RLDX-1 ένα πολλά υποσχόμενο βήμα προς αξιόπιστα VLAs για σύνθετη, πλούσια σε επαφές και δυναμική επιδέξια χειραγώγηση στον πραγματικό κόσμο.

Source: arXiv:2605.03269v2 Announce Type: cross