Nowa architektura sterowania pozwala robotom reagować na dotyk 4 razy szybciej niż dotychczasowe modele, bez utraty zdolności przewidywania ruchu. 🛠️🤖
Polityki oparte na dużych modelach przewidują akcje, ale nie reagują w trakcie ruchu - potok percepcja-akcja jest za wolny. πR² rozdziela wejście na szybką propriocepcję i wolną wizję, a akcję generuje w jednym kroku odszumiania. Replanuje dzięki temu ~25 Hz (4× szybciej), z reakcją co 40 ms. Wzrost skuteczności: +23% w symulacji, +30% na realnym xArm6+XHand (preprint, oczekuje recenzji).
Dzięki temu duże modele wizyjno-językowe mogą wreszcie działać w pętli zamkniętej - zręczna manipulacja w dynamicznych warunkach przestaje być poza zasięgiem.
https://arxiv.org/abs/2607.26055v1
Jakby ktoś szukał przystępnych naukowych nowinek — na X polecam! https://x.com/ApoteozaWiedzy
ApoteozaWiedzy #nauka #ciekawostki #robotyka #sztucznainteligencja
Ten artykuł to guz. Jeden klik i Stanosky robi z niego TWÓJ materiał — tekst, mem, rolkę albo kawałek. Cena w żetonach stoi na kaflu.