Wszystkie newsyPremiery

Google DeepMind dzieli robotyczny mózg na trzy modele

Opublikowano: 30.07.2026 · Źródło: Google DeepMind

Google DeepMind wydał 30 lipca 2026 r. drugą generację swojego stosu fizycznej sztucznej inteligencji, a najciekawszy jest jej kształt: zamiast jednego modelu robotycznego są trzy. Gemini Robotics ER 2 myśli, Gemini Robotics 2 zamienia plany na ruch całego ciała, a Gemini Robotics On-Device 2 działa na samym robocie, więc maszyna pracuje dalej bez łączności z siecią. Model rozumujący powstał na bazie Gemini 3.5 Flash i — zgodnie z kartą modelu — przyjmuje przeplatany tekst, obrazy, wideo i dźwięk w oknie 128 tys. tokenów, a zwraca do 64 tys. tokenów. Zmiana wobec linii ER 1.x dotyczy czasu, nie kosmetyki: wcześniejsze wersje oceniały pojedynczą klatkę albo krótki fragment, a ER 2 rozumuje na ciągłym strumieniu wideo i pamięta, co już zrobił, w skali minut pracy — to różnica między rozpoznaniem sceny a pamiętaniem roboty. Dostęp też jest podzielony. ER 2 jest dostępny przez Gemini API i Google AI Studio, platforma Gemini Enterprise Agent działa w prywatnym podglądzie, a dwa modele wykonawcze trafiają do producentów robotów przez współpracę; wagi we wszystkich trzech przypadkach pozostają zamknięte. Karta modelu DeepMind nietypowo wprost stawia granice: wyklucza zastosowania krytyczne dla bezpieczeństwa w ochronie zdrowia, transporcie i wszędzie tam, gdzie awaria mogłaby komuś zaszkodzić, i osobno raportuje testy przestrzegania instrukcji bezpieczeństwa oraz nadzoru nad bezpieczeństwem ludzi. Katalog wujec.ai ma już linię z 2026 r. jako osobny profil; pierwsza generacja z 2025 r. zostaje na swoim miejscu.