
FLUX-mimic to model wideo-akcja (Video-Action Model, VAM) opracowany przez mimic robotics wspolnie z Black Forest Labs. Laczy generatywny model wideo FLUX 3 z dekoderem akcji: model, ktory dzieki wielkoskalowemu treningowi wideo rozumie juz dynamike i zachowanie swiata, jest wykorzystywany do przewidywania akcji robota.
W odroznieniu od modeli Vision-Language-Action trenowanych na statycznych obrazach, oparcie o generatywny model wideo pozwala dostroic robota do konkretnego zadania przy zaledwie okolo 30 minutach danych robota, zamiast wymaganych wczesniej 30 lub wiecej godzin — co radykalnie przyspiesza przemyslowe uczenie robotow.
FLUX-mimic jest wdrazany m.in. w Audi Production Lab, gdzie wspiera zadania manipulacji obiektami miekkimi w produkcji motoryzacyjnej, wczesniej wykonywane recznie.
Rola uczenia robotów opisuje oprogramowanie służące do trenowania polityk sterowania i umiejętności manipulacyjnych/lokomocyjnych robota metodami uczenia maszynowego. Obejmuje: uczenie ze wzmocnieniem (reinforcement learning) w symulacji z transferem sim-to-real, uczenie imitacyjne (imitation learning) i uczenie z demonstracji (learning from demonstration), trening modeli Vision-Language-Action (VLA), oraz fine-tuning foundation models robotyki. Typowo wykorzystuje masowo zrównoleglone środowiska symulacyjne (Isaac Lab, MuJoCo) do generowania danych treningowych, a następnie wdraża wytrenowane polityki na fizycznym robocie.
Robot Control oznacza rolę oprogramowania odpowiedzialnego za sterowanie ruchem, wykonywanie komend, koordynację działania elementów wykonawczych oraz bezpośrednią logikę operacyjną robota.
Audi Production Lab — manipulacja obiektami miekkimi w produkcji motoryzacyjnej.