PolicyTrim przyspiesza roboty VLA nawet 5,83× bez treningu
Zespół z Uniwersytetu Syczuańskiego przedstawił PolicyTrim — dwuetapowy framework RL, który skraca czas wykonania zadań przez roboty VLA nawet 5,83× w symulacji i 1,86× na realnym robocie, bez treningu od zera.