Jamba Reasoning 3B
AI21 Labs · Israel · 2025
Pierwszy model rozumujący AI21 i najczęściej pobierane wydanie firmy — trzy miliardy parametrów działające na laptopie, okno 256 tysięcy tokenów i opublikowane liczby wyników zamiast zwyczajowych wykresów bez skali.
Jamba Reasoning 3B, wydany 8 października 2025, był pierwszą próbą AI21 Labs zbudowania modelu, który myśli, zanim odpowie — i to na sprzęcie, którego z rozumowaniem nikt nie kojarzy: laptopach, telefonach i pojedynczych kartach konsumenckich. Producent podaje 40 tokenów na sekundę na MacBooku Pro z układem M3 przy kontekście 32 tysięcy tokenów. Budowa to hybryda Jamby w małej skali, tym razem podana przez producenta dokładnie: 28 warstw, z czego 26 to bloki Mamby (model przestrzeni stanów), a tylko 2 to warstwy uwagi, przy 20 głowicach zapytań dzielących jedną głowicę klucza i wartości. Ta proporcja jest powodem, dla którego model o trzech miliardach parametrów utrzymuje 256 tysięcy tokenów kontekstu — to uwaga zmusza model do trzymania rosnącej pamięci podręcznej w miarę wydłużania rozmowy, a ta sieć prawie z niej nie korzysta. Przy wynikach modelowi należy się uznanie za opublikowanie konkretnych liczb, czego AI21 nie zrobiło już przy późniejszej generacji Jamba2. Firma podaje MMLU-Pro 61,0%, Humanity's Last Exam 6,0% i IFBench 52,0%, w tabeli z nazwanymi rywalami. Uderzający jest wynik IFBench: 52% wobec 33% najbliższego rywala w tej samej tabeli. Do deklaracji o pokonaniu konkurencji trzeba jednak dopisać zastrzeżenie, i to wprost z tej tabeli: w teście MMLU-Pro Qwen 3 4B ma 70% wobec 61% Jamby Reasoning 3B. Twierdzenie AI21 opiera się na średniej z sześciu testów, a nie na wygranej w każdym z nich. Osobnej uwagi wymaga licencja. Ogłoszenie AI21 mówi wprost, że model wydano na licencji Apache 2.0; karta modelu na Hugging Face nosi etykietę Apache 2.0, ale podlinkowuje też odrębną otwartą licencję AI21. Najjaśniejszą wypowiedzią producenta jest ogłoszenie i za nim idzie ten profil. Model został zastąpiony 8 stycznia 2026 przez Jamba2 3B, która zachowuje ten sam rozmiar i okno kontekstu, ale porzuca ramę rozumowania na rzecz wykonywania poleceń i wierności źródłom. Jamba Reasoning 3B nadal jest do pobrania, także w skwantowanej wersji GGUF dla llama.cpp i LM Studio, i pozostaje najczęściej pobieranym z nowszych wydań AI21.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!