Rękawica Omnibody Hand: rewolucja w nauce robotów przez imitację w zaledwie 30 minut!
Podczas gdy większość deweloperów stara się programować dla robotów każdy ruch za pomocą skomplikowanych algorytmów lub zmuszają operatorów do spędzania godzin w hełmach VR, startup Reward AI postanowił pójść drogą najmniejszego oporu. Stworzyli system, w którym maszyna po prostu „obserwuje” ludzkie ruchy i je naśladuje. Głównym narzędziem w tym procesie jest rękawica Omnibody Hand.
Sprzęt do odczytu rzeczywistości
Omnibody Hand to nie tylko kolejny manipulator, lecz urządzenie nasycone sensorami do zbierania danych. Wyposażona jest w czujniki dotykowe, sensory zbliżeniowe oraz kamery z globalnym migawką. Taki zestaw umożliwia rejestrowanie nie tylko trajektorii ruchu ręki, ale i najdrobniejszych szczegółów interakcji z obiektami: od momentu zbliżenia po siłę i charakter chwytu.
Do precyzyjnego śledzenia położenia w przestrzeni deweloperzy Reward AI połączyli system wizualno-inercyjny z elektromagnetycznym pozycjonowaniem. Takie połączenie okazało się skuteczne: podczas testów przy wysokich prędkościach średni błąd migracji zadanej punktu zmniejszył się o 60%. To krytyczne, gdy chodzi o delikatne manipulacje, gdzie każdy dodatkowy centymetr może oznaczać stłuczenie szkła lub uszkodzenie detalu.
OM-1 przetwarza multimodalne strumienie sensorów pozyskane za pomocą systemu Omnibody Hand i generuje działania z prędkością właściwą dla człowieka, dla różnych form robotycznych. Ilustracja: Reward AI
Model OM-1: nauka bez pośredników
Wszystkie zebrane dane trafiają do OM-1 - uniwersalnego modelu zarządzania. Jego cechą jest to, że uczy się bezpośrednio z demonstracji człowieka. Nie ma tutaj potrzeby teleobecności ani wcześniejszego „szkolenia” na konkretnym sprzęcie. Model absorbuje obrazy, sygnały dotykowe, dane o odległości między palcami oraz trajektorię ręki.
Na wyjściu OM-1 podaje precyzyjne parametry: kierunek, prędkość ruchu, siłę i chwile kluczowych wydarzeń. Według firmy, do opanowania nowego zadania, włącznie z trudnymi działaniami kontaktowymi i długimi sekwencjami ruchów, system potrzebuje mniej niż 30 minut nagrań. W świecie nauki robotów przez naśladowanie to niemal natychmiastowo.
Autonomia i adaptacyjność
Bezpośrednim wykonaniem poleceń zajmuje się osobna warstwa zarządzania, która została wcześniej przeszkolona z użyciem wzmocnienia w symulacji. Działa na wysokiej częstotliwości niezależnie od prędkości pracy głównego modelu OM-1. Pozwala to na wygładzanie przejść między działaniami oraz kompensowanie opóźnień lub zakłóceń zewnętrznych. Główną zaletą takiego podejścia jest uniwersalność: nauczone umiejętności można przenosić między różnymi platformami robotycznymi bez potrzeby przeszkalania modelu pod każdy nowy manipulator.
Podczas gdy branża debatuje, czy AI zastąpi programistów, Reward AI wyraźnie pokazuje, że może on zupełnie zastąpić skomplikowane instrukcje prostą demonstracją „rób jak ja”.
Podczas gdy jedni uczą roboty poruszać się, inni optymalizują sprzęt dla ich „umysłów”. Tak, Samsung przestaje produkować DDR5, zlecając produkcję na zewnątrz, aby całkowicie skupić się na rozwiązaniach dla sztucznej inteligencji.