Qwen3.6-35B-A3B
Alibaba Cloud · China · 2026
Pierwszy model Qwen3.6 z otwartymi wagami: mieszanka ekspertów o 35 miliardach parametrów, z których na token pracują trzy miliardy, nastawiona na pracę agentową, a nie na wyższe wyniki testów.
Qwen3.6-35B-A3B, opublikowany 15 kwietnia 2026 r., to pierwsze wydanie linii Qwen3.6 z otwartymi wagami i wydanie nietypowo uczciwe: w większości własnych tabel producenta nie wygrywa z modelem Qwen3.5-27B, gęstym modelem poprzedniej generacji sprzed siedmiu tygodni. To porównanie warto przeczytać uważnie, bo mówi, co właściwie znaczy tutaj podniesienie numeru wersji. Qwen3.5-27B ma wyższe wyniki na SWE-bench Verified (75,0 wobec 73,4), SWE-bench Multilingual (69,3 wobec 67,2), SWE-bench Pro (51,2 wobec 49,5), MMLU-Pro (86,1 wobec 85,2) i Humanity's Last Exam (24,3 wobec 21,4). Nowszy model wyraźnie odskakuje tam, gdzie liczy się długa, prowadzona narzędziami praca, którą naprawdę wykonuje samodzielny agent: Terminal-Bench 2.0 — 51,5 wobec 41,6, QwenWebBench — 1397 wobec 1068, NL2Repo — 29,4 wobec 27,3. Wobec bezpośredniego poprzednika o tej samej wielkości i rzadkości, modelu Qwen3.5-35B-A3B, postęp nie budzi wątpliwości: Terminal-Bench z 40,5 na 51,5, QwenWebBench z 978 na 1397, NL2Repo z 20,5 na 29,4. Konstrukcję tłumaczy rachunek kosztów. To mieszanka ekspertów: 35,95 miliarda parametrów w pamięci, 256 ekspertów, z których na dany token uruchamia się 8 wybranych i 1 wspólny, czyli aktywne są mniej więcej 3 miliardy. Uruchomienie takiego modelu kosztuje na token około ósmej części tego, co gęsty model 27B, a wiedzy niesie więcej — i to jest wymiana, na której zależy agentowi wykonującemu setki wywołań narzędzi w jednym zadaniu. Układ to 40 warstw jako dziesięć powtórzeń trzech bloków Gated DeltaNet zakończonych blokiem uwagi bramkowanej, wymiar ukryty 2048, słownik 248 320, przewidywanie wielu tokenów i okno kontekstu liczące natywnie 262 144 tokeny, które według Alibaby rozciąga się do 1 010 000. Jednego szczegółu nota wydawnicza nie wymienia: plik konfiguracyjny nadal opisuje architekturę jako `qwen3_5_moe`. Numer wersji przeszedł z 3.5 na 3.6, konstrukcja nie. Alibaba przedstawia to wydanie jako zbudowane na uwagach społeczności i stawiające na „stabilność i praktyczną przydatność” — liczby to potwierdzają: mamy do czynienia z poprawką w treningu końcowym i uczeniu ze wzmocnieniem, nie z nową rodziną modeli. Widoczna dla użytkownika zmiana to zachowywanie rozumowania: tok myślenia z wcześniejszych wiadomości można teraz przenieść dalej w rozmowie, zamiast wytwarzać go od nowa w każdej turze. Widzenie jest standardem, jak wszędzie w tej generacji, z wynikami zasadniczo równymi Qwen3.5-27B i umiarkowanym postępem w lokalizowaniu obiektów (ODInW13 50,8 wobec 42,6) oraz rozumieniu wideo (VideoMMMU 83,7 wobec 82,3). Wagi na licencji Apache 2.0. Wszystkie powyższe liczby pochodzą od producenta i nie zostały niezależnie powtórzone.
▸Newsy
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!