Qwen3.5-122B-A10B
Alibaba Cloud · China · 2026
Drugi co do wielkości model generacji Qwen3.5: 125 miliardów parametrów, z których na token pracuje dziesięć, prowadzący nad wszystkim, co stoi poniżej niego, w wiedzy, rozumowaniu i matematyce obrazowej.
Qwen3.5-122B-A10B, opublikowany 24 lutego 2026 r., stoi o szczebel niżej niż flagowiec generacji, model 397B-A17B, którego Alibaba również publikuje otwarcie. Pliki wag zawierają 125,1 miliarda parametrów; każdy token trafia do ośmiu z 256 ekspertów plus jednego eksperta wspólnego, więc w danej chwili pracuje około dziesięciu miliardów. We własnej rodzinie prowadzi tam, gdzie najbardziej liczy się pojemność. Alibaba podaje MMLU-Pro 86,7, SuperGPQA 67,1, GPQA Diamond 86,6, Humanity's Last Exam z łańcuchem rozumowania 25,3 i z narzędziami 47,5 oraz Terminal Bench 2 na poziomie 49,4 — ten ostatni wynik jest wyraźnie wyżej niż hostowanego GPT-5-mini (31,9) i GPT-OSS-120B (18,7). W pracy agentowej notuje BFCL-V4 72,2 i Browsecomp 63,8. Nie prowadzi natomiast w wykonywaniu poleceń i w matematyce pod presją — jedno i drugie zabiera mu mniejszy, gęsty model 27B (IFEval 95,0 wobec 93,4, PolyMATH 71,2 wobec 68,9). To dobre przypomnienie, że w tej generacji rozmiar nie układa się w jeden ranking. Widzenie jest wtrenowane, a nie doklejone, i wyniki są najlepsze w rodzinie: MMMU 83,9, MMMU-Pro 76,9, MathVision 86,2 wobec 80,6, 69,3 i 74,6 dla Qwen3-VL-235B-A22B, czyli wyspecjalizowanego modelu wizyjnego poprzedniej generacji o prawie dwukrotnie większej liczbie parametrów. Budowa to 48 warstw jako dwanaście powtórzeń trzech bloków Gated DeltaNet i jednego bloku uwagi bramkowanej, każdy zakończony mieszaniną ekspertów; wymiar ukryty 3072, szerokość eksperta 1024, 32 głowice zapytań na dwie głowice klucza i wartości, słownik 248 320 tokenów, trening z przewidywaniem wielu tokenów naraz. Kontekst to 262 144 tokeny natywnie, wg producenta rozciągalne do 1 010 000. Licencja to Apache 2.0 z niezmienionym tekstem licencji w repozytorium. Pobrań jest około 700 tysięcy w oknie trzydziestu dni — ułamek tego, co notują modele małe, czego należy oczekiwać po modelu wymagającym pamięci serwerowej, a nie biurkowej.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!