π0.6 (pi-zero-6) to robotyczny model fundacyjny typu wizja-jezyk-akcja (VLA) opracowany przez Physical Intelligence. Jest kolejna wersja w linii π — udoskonaleniem modelu π0.5 opartym na nieco wiekszym backbone — i pelni role warstwy decyzyjnej (mozgu) robotow, m.in. stacjonarnego humanoida OP1 firmy Ultra Robotics.
Wariant π*0.6 (pi-star-0.6) trenowany jest metoda Recap („RL with Experience & Corrections via Advantage-conditioned Policies”) — trojstopniowym procesem laczacym uczenie z demonstracji, korekty eksperckie oraz autonomiczne uczenie ze wzmocnieniem na podstawie wlasnego doswiadczenia robota. Trening na autonomicznym doswiadczeniu ponad dwukrotnie zwieksza przepustowosc na najtrudniejszych zadaniach i zmniejsza wskaznik bledow co najmniej dwukrotnie.
Model zademonstrowano na zlozonych, wielogodzinnych zadaniach w swiecie rzeczywistym: przygotowywanie kawy/espresso (praca od 5:30 do 23:30), skladanie prania (50 nowych przedmiotow w nowym otoczeniu) oraz skladanie 59 pudelek na linii pakowania czekolady, osiagajac ponad 90% skutecznosci. Prace opublikowano 17 listopada 2025 r.