IBM Granite 4.2 3B
IBM · USA · 2026
Najmniejszy Granite, który wciąż rozumuje - i wywołuje narzędzia równie celnie jak model dwa razy większy, choć jego wyniki wielojęzyczne załamują się w sposób, przed którym wspólna karta rodziny nie ostrzega.
Granite-4.2-3B to wejście do rodziny modeli rozumujących IBM, opublikowane 25 sierpnia 2026 r. w tej samej konstrukcji co więksi bracia: gęsty transformer, tok rozumowania w znacznikach <think>, trzy przełączane tryby myślenia i czysta licencja Apache 2.0. Przy 3,66 miliarda parametrów jest pomyślany na laptopy, urządzenia brzegowe i wszędzie tam, gdzie karty graficznej nie ma pewnej. Jeden wynik zwraca uwagę i nie jest to ten, który IBM eksponuje. W teście BFCL v4, standardowym sprawdzianie wywoływania funkcji, wersja 3B osiąga 52,41 wobec 52,39 u wersji 8B - remis z modelem ponad dwukrotnie większym. Przy typowym firmowym zadaniu, czyli zamianie zdania na poprawnie zbudowane wywołanie API, mały model nie oddaje praktycznie nic. Rozumowanie też trzyma się lepiej, niż sugeruje rozmiar: 78,33 w AIME25 i 69,71 w LiveCodeBench v6. Załamanie jest gdzie indziej i dla europejskiego czytelnika znaczy więcej niż którykolwiek z nagłówkowych wyników. W MMLU-ProX lite, własnym teście wielojęzycznym IBM, wersja 3B osiąga 27,78, podczas gdy 8B sięga 61,06. W Arena-Hard-V2 spada do 34,96 wobec 65,19. Oba modele wymieniają te same dwanaście przetestowanych języków na tej samej wspólnej karcie, ale tylko jeden z nich rzeczywiście tak się zachowuje. Wersję 3B należy traktować jak model angielski, który widział inne języki, a nie jak model wielojęzyczny - a polskiego na liście IBM i tak nie ma. Granice pracy z długim dokumentem są równie wyraźne: RULER spada do 67,52 przy 64 tysiącach tokenów i 55,30 przy 128 tysiącach, więc rozszerzenie do 512 tysięcy, reklamowane dla całej rodziny, nie jest obietnicą dotyczącą tego rozmiaru. Naprawdę mocny jest tam, gdzie go zbudowano: jako tani model o swobodnej licencji, uruchamiany lokalnie, umiejący zaplanować krótki ciąg kroków i sterować narzędziami bez wychodzenia do sieci. Konwersje GGUF, FP8, MXFP4 i NVFP4 IBM publikuje sam, a repozytorium skwantyzowane pobierane jest mniej więcej ośmiokrotnie częściej niż pełne wagi.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!