IBM Granite 4.1 30B
IBM · USA · 2026
Największy model pokolenia poprzedzającego Granite 4.2: 28,9 miliarda gęstych parametrów, kontekst 128 tys. tokenów, licencja Apache 2.0 i brak trybu rozumowania.
Granite-4.1-30B to największy model rodziny Granite 4.1 IBM, opublikowany 29 kwietnia 2026 r. — cztery miesiące przed pokoleniem Granite 4.2, które go zastąpiło. Opisujemy go, bo modele 4.1 nadal notują sześciocyfrowe liczby pobrań miesięcznie i pozostają wersją, na której zbudowano wiele działających wdrożeń. Konstrukcja jest celowo niemodna: gęsty transformer dekoderowy, 64 warstwy, wymiar osadzeń 4096, 32 głowice uwagi z 8 głowicami klucz-wartość, długość sekwencji 131 072 tokeny i pozycje RoPE. Gęsty oznacza, że każdy z 28,87 miliarda parametrów pracuje przy każdym tokenie — bez kierowania do ekspertów, którym chińscy rywale z tego samego sezonu obniżali koszt wnioskowania. Zyskiem jest przewidywalność: zużycie pamięci i opóźnienie nie zależą od tego, których ekspertów obudzi zapytanie. Własna ewaluacja IBM daje 80,16 w MMLU, 64,09 w MMLU-Pro, 45,76 w GPQA, średnio 89,65 w IFEval, 88,41 w HumanEval i 73,68 w BFCL v3 sprawdzającym wywoływanie narzędzi. Wielojęzyczne MMLU wypada na 73,71 w jedenastu językach. Wszystkie te liczby pochodzą od producenta. Różnica wobec pokolenia 4.2 nie polega na rozmiarze, tylko na zachowaniu. Granite 4.2 dołożyło wbudowany łańcuch rozumowania z przełączanymi trybami myślenia; 4.1 nie ma go wcale — to model instrukcyjny, który odpowiada wprost. Tam, gdzie widoczny ślad rozumowania jest zbędnym narzutem, bywa to zaleta, a nie brak. Licencja to czyste Apache 2.0: bez wyłączeń terytorialnych, bez progu przychodowego, bez osobnego dokumentu o dopuszczalnym użyciu. Dla europejskiego czytelnika to nadal najmniej obciążona podstawa, na jakiej publikuje się wagi tej klasy.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!