MDL-3140EST.2025 · IDX.340
Model językowyW produkcji

Jamba Reasoning 3B

AI21 Labs · Israel · 2025

Pierwszy model rozumujący AI21 i najczęściej pobierane wydanie firmy — trzy miliardy parametrów działające na laptopie, okno 256 tysięcy tokenów i opublikowane liczby wyników zamiast zwyczajowych wykresów bez skali.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Jamba Reasoning 3B, wydany 8 października 2025, był pierwszą próbą AI21 Labs zbudowania modelu, który myśli, zanim odpowie — i to na sprzęcie, którego z rozumowaniem nikt nie kojarzy: laptopach, telefonach i pojedynczych kartach konsumenckich. Producent podaje 40 tokenów na sekundę na MacBooku Pro z układem M3 przy kontekście 32 tysięcy tokenów. Budowa to hybryda Jamby w małej skali, tym razem podana przez producenta dokładnie: 28 warstw, z czego 26 to bloki Mamby (model przestrzeni stanów), a tylko 2 to warstwy uwagi, przy 20 głowicach zapytań dzielących jedną głowicę klucza i wartości. Ta proporcja jest powodem, dla którego model o trzech miliardach parametrów utrzymuje 256 tysięcy tokenów kontekstu — to uwaga zmusza model do trzymania rosnącej pamięci podręcznej w miarę wydłużania rozmowy, a ta sieć prawie z niej nie korzysta. Przy wynikach modelowi należy się uznanie za opublikowanie konkretnych liczb, czego AI21 nie zrobiło już przy późniejszej generacji Jamba2. Firma podaje MMLU-Pro 61,0%, Humanity's Last Exam 6,0% i IFBench 52,0%, w tabeli z nazwanymi rywalami. Uderzający jest wynik IFBench: 52% wobec 33% najbliższego rywala w tej samej tabeli. Do deklaracji o pokonaniu konkurencji trzeba jednak dopisać zastrzeżenie, i to wprost z tej tabeli: w teście MMLU-Pro Qwen 3 4B ma 70% wobec 61% Jamby Reasoning 3B. Twierdzenie AI21 opiera się na średniej z sześciu testów, a nie na wygranej w każdym z nich. Osobnej uwagi wymaga licencja. Ogłoszenie AI21 mówi wprost, że model wydano na licencji Apache 2.0; karta modelu na Hugging Face nosi etykietę Apache 2.0, ale podlinkowuje też odrębną otwartą licencję AI21. Najjaśniejszą wypowiedzią producenta jest ogłoszenie i za nim idzie ten profil. Model został zastąpiony 8 stycznia 2026 przez Jamba2 3B, która zachowuje ten sam rozmiar i okno kontekstu, ale porzuca ramę rozumowania na rzecz wykonywania poleceń i wierności źródłom. Jamba Reasoning 3B nadal jest do pobrania, także w skwantowanej wersji GGUF dla llama.cpp i LM Studio, i pozostaje najczęściej pobieranym z nowszych wydań AI21.

#open weights#Apache 2.0#Mamba#reasoning#on-device#long context
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję