gpt-oss-120b
OpenAI · United States · 2025
Pierwszy model OpenAI z otwartymi wagami od czasu GPT-2 — 117 mld parametrów, licencja Apache 2.0, mieści się na jednej karcie H100.
gpt-oss-120b, opublikowany 5 sierpnia 2025 r., zakończył sześcioletni okres, w którym OpenAI nie wydalo żadnych wag do pobrania — ostatnim takim modelem był GPT-2 z 2019 r. To transformer typu mixture-of-experts o około 117 miliardach parametrów, z których na token aktywnych jest około 5,1 miliarda; OpenAI zaprojektowało go tak, by mieścił się na pojedynczym akceleratorze H100 z 80 GB pamięci. Okno kontekstu to 131 072 tokeny i tyle samo model może wygenerować na wyjściu, co jest układem rzadko spotykanym. Granica wiedzy to 1 czerwca 2024 r. Wysiłek rozumowania można ustawić na niski, średni lub wysoki, a pełny łańcuch rozumowania jest widoczny, a nie streszczany — to świadoma decyzja producenta, uzasadniona łatwiejszym debugowaniem i nadzorem, której modele hostowane przez OpenAI nie oferują. Model wywołuje funkcje, przeszukuje sięć, uruchamia Pythona i zwraca ustrukturyzowane wyjście, można go też douczać. Licencja to Apache 2.0, bez copyleftu i bez ograniczenia pola zastosowań, więc wdrożenie komercyjne jest dozwolone wprost. Samo OpenAI nie udostępnia tego modelu we własnym API — opublikowane limity zapytań wynoszą zero na każdym szczeblu — więc kto chce go w chmurze, wynajmuje go u dostawcy zewnętrznego albo uruchamia u siebie.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!