Grok 4.20 ruszył w marcu 2026 roku jako pierwszy model gałęzi 4.20 i to on nadał kształt całej linii: okno kontekstu miliona tokenów, wejście tekstowe i obrazowe oraz dwustopniowe rozliczenie, w którym zapytanie sięgające 200 000 tokenów przecenia całe zapytanie po stawce dwukrotnie wyższej. xAI opisuje go jako model szybki, zbudowany pod agentowe wywoływanie narzędzi, i przypisuje mu najniższy na rynku wskaźnik halucynacji oraz ścisłe trzymanie się polecenia - deklaracji, której przy późniejszych wersjach firma już nie powtórzyła. To także granica cichej zmiany w API: pola logprobs i top_logprobs są po prostu ignorowane przez Grok 4.20 i wszystko, co wyszło po nim. Po półroczu model wciąż jest w sprzedaży, wciąż jest tańszy od późniejszych flagowców 4.5 i 4.6 i wciąż przyjmuje dwa razy większy kontekst niż one.