MDL-2385EST.2026 · IDX.854
Model językowyW produkcji

Qwen3.5-9B

Alibaba Cloud · China · 2026

Najczęściej pobierany model generacji Qwen3.5: gęsty model wizyjno-językowy o 9 miliardach parametrów na licencji Apache 2.0, który na kilku testach rozumowania wyprzedza konkurentów trzynaście razy od siebie większych.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Qwen3.5-9B to koń roboczy generacji Qwen3.5, opublikowany przez Alibabę pod koniec lutego 2026 r. i zdecydowanie najczęściej pobierany model, jaki zespół Qwen dziś udostępnia — około 12,6 miliona pobrań z Hugging Face w oknie trzydziestu dni, więcej niż jakikolwiek pojedynczy model generacji 3.6 czy 3.8. Najważniejsza zmiana w tej generacji polega na tym, że widzenie nie jest już doklejane z boku. Wcześniejsze wydania Qwena miały osobną linię tekstową i osobną linię -VL; Qwen3.5 od początku trenowany jest na wymieszanych tokenach tekstu i obrazu, a liczby producenta pokazują, że model 9B bije poprzedni, wyspecjalizowany model wizyjny Qwen3-VL-30B-A3B we wszystkich testach, choć jest od niego trzy razy mniejszy — MathVision 78,9 wobec 65,7, MMMU-Pro 70,1 wobec 63,0, a na teście VlmsAreBlind, zbudowanym z obrazów, których nie da się zgadnąć ze znajomości języka, 93,7 wobec 72,5. W tekście zajmuje podobną pozycję. Wobec modelu GPT-OSS-120B od OpenAI, trzynaście razy większego, producent podaje wyższe wyniki na MMLU-Pro (82,5 wobec 80,8), GPQA Diamond (81,7 wobec 80,1), IFEval (91,5 wobec 88,9) i w wyszukiwaniu w długim kontekście (AA-LCR 63,0 wobec 50,7). Ustępuje tam, gdzie nadal decyduje sama pojemność: LiveCodeBench v6 65,6 wobec 82,7 i matematyka olimpijska (HMMT) niżej o mniej więcej siedem punktów. Wszystkie te liczby pochodzą od producenta. Architektura jest hybrydowa: 32 warstwy ułożone w osiem powtórzeń trzech bloków Gated DeltaNet zakończonych blokiem uwagi bramkowanej, wymiar ukryty 4096, słownik 248 320 tokenów, trening z przewidywaniem wielu tokenów naraz. To właśnie uwaga liniowa w trzech warstwach na cztery utrzymuje zużycie pamięci w ryzach przy oknie kontekstu liczącym natywnie 262 144 tokeny, które według Alibaby rozciąga się do 1 010 000. Tryb rozumowania jest domyślnie włączony i można go wyłączyć w pojedynczym zapytaniu. Dla czytelnika spoza świata anglojęzycznego istotna jest deklaracja obsługi 201 języków i dialektów. Alibaba nie publikuje tej listy, więc z karty modelu nie da się sprawdzić, czy polski jest traktowany jako język pełnoprawny; karta podaje natomiast wyniki zbiorcze — 81,2 na MMMLU, 76,3 na MMLU-ProX uśrednione po 29 językach i 72,6 na teście tłumaczeniowym obejmującym 55 języków. Wagi są na licencji Apache 2.0, pełny tekst licencji leży w repozytorium i nie towarzyszą mu żadne dodatkowe ograniczenia użycia.

#open weights#dense#multimodal#local deployment#China#small model
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję