gpt-oss-20b wyszedł 5 sierpnia 2025 r. razem z większym gpt-oss-120b i dzieli z nim architekturę, licencję oraz założenia projektowe przy mniej więcej piątej części rozmiaru: około 21 miliardów parametrów, z czego 3,6 miliarda aktywnych na token. OpenAI kieruje go do zastosowań wymagających niskich opóźnień, pracy lokalnej i specjalistycznego douczania, a nie do najtrudniejszych zadań rozumowych.
Reszta specyfikacji odpowiada większemu modelowi. Okno kontekstu to 131 072 tokeny i tyle samo na wyjściu, granica wiedzy to 1 czerwca 2024 r., wysiłek rozumowania można ustawić na niski, średni lub wysoki, a pełny łańcuch rozumowania jest zwracany. Function calling, przeglądanie sieci, uruchamianie Pythona i ustrukturyzowane wyjście działają natywnie, wagi można douczać.
Licencja to Apache 2.0. Podobnie jak przy gpt-oss-120b, OpenAI nie udostępnia tego modelu we własnym API — opublikowane limity zapytań wynoszą zero na każdym szczeblu — więc trafia do użytkowników przez dostawców zewnętrznych albo przez lokalne środowiska na sprzęcie konsumenckim, czyli dokładnie tam, gdzie ma sens jego rozmiar.
#open weights#Apache 2.0#mixture of experts#on-device#low latency