π0.5 (pi-0.5)
Physical Intelligence · USA · 2025
Model π, który wyszedł z laboratorium — sprząta kuchnie i ściele łóżka w domach, w których nigdy nie był.
π0.5, opublikowany przez Physical Intelligence 22 kwietnia 2025 r., był odpowiedzią firmy na najtrudniejsze pytanie w uczeniu robotów: co się dzieje, gdy robot trafia do domu, w którym nikt go nie trenował. Bazuje na architekturze wizja-język-akcja z π0, ale jest współtrenowany na celowo niejednorodnej mieszance danych — około 400 godzinach demonstracji manipulacji mobilnej, danych z robotów stacjonarnych pracujących w wielu różnych domach, korpusie wieloplatformowym z π0, multimodalnych danych z sieci (odpowiadanie na pytania, opisywanie obrazów, wykrywanie obiektów) oraz epizodach z „instrukcją słowną", w których człowiek prowadzi robota przez zadanie krok po kroku. Model rozumuje dwuetapowo. Najpierw przewiduje wysokopoziomowy krok semantyczny w postaci dyskretnych tokenów — mówi więc sam sobie, co ma teraz zrobić — a potem ekspert akcji o 300 mln parametrów, oparty na flow matching, zamienia tę intencję w ciągłe komendy dla silników. Kluczowe ustalenie Physical Intelligence dotyczyło szerokości, a nie głębokości danych: gdy trening objął około stu różnych środowisk, skuteczność w zupełnie nowym domu zbliżyła się do polityki trenowanej właśnie w tym domu. Pokazy obejmowały kilkuminutowe zadania, takie jak sprzątanie naczyń do zlewu i ścielenie łóżka w nieznanych wcześniej kuchniach i sypialniach. W odróżnieniu od zamkniętych π*0.6 i π0.7, które przyszły później, π0.5 trafił do odbiorców: we wrześniu 2025 roku Physical Intelligence dołożyło do repozytorium openpi punkt kontrolny pi05_base na licencji Apache 2.0, razem z obsługą PyTorcha, więc model można uruchamiać i dostrajać poza firmą.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!