Wystarczy jedno nagranie, by robot natychmiast nauczył się złożonej manipulacji - bez żadnego treningu. 🤖
RoboTTT, model z NVIDIA i Stanford, łączy uczenie w czasie testu z politykami VLA, by przetwarzać 8K kroków kontekstu (1000× więcej niż dotąd) bez opóźnień. Daje to uczenie z pojedynczego nagrania, poprawę polityki na bieżąco i odporność. Wyniki: +87% vs baza, +62% vs 1K kontekst. Po raz pierwszy kończy 5-minutowe, 10-etapowe zadanie montażowe. (preprint, oczekuje recenzji)
Otwiera to drogę do robotów, które uczą się z jednej demonstracji i adaptują w czasie rzeczywistym do złożonych zadań.
https://arxiv.org/abs/2607.15275v1
Jakby ktoś szukał przystępnych naukowych nowinek — na X polecam! https://x.com/ApoteozaWiedzy
ApoteozaWiedzy #nauka #ciekawostki #robotyka #sztucznainteligencja