Qwen3.5-27B
Alibaba Cloud · China · 2026
Gęsty model o 27 miliardach parametrów, który otworzył generację Qwen3.5 — i nadal ma wyższe wyniki niż rzadszy model, który zastąpił go dwa miesiące później.
Qwen3.5-27B, opublikowany 24 lutego 2026 r., otworzył generację Qwen3.5 Alibaby i pozostaje najzdolniejszym modelem o otwartych wagach, jaki ta firma wydała w rozmiarze mieszczącym się na jednym akceleratorze klasy serwerowej. Jego miejsce w katalogu jest nietypowe. Poprzedni flagowiec Alibaby z otwartymi wagami, Qwen3-235B-A22B, trzymał w pamięci 235 miliardów parametrów. We własnej tabeli producenta gęsty model 27B bije go na MMLU-Pro (86,1 wobec 84,4), GPQA Diamond (85,5 wobec 81,1), Humanity's Last Exam z tokiem rozumowania (24,3 wobec 18,2), IFEval (95,0 wobec 87,8) i IFBench (76,5 wobec 51,7) — ośmiokrotne zmniejszenie liczby przechowywanych parametrów, przy którym wyniki poszły w górę, a nie w dół. Wobec modelu GPT-5-mini od OpenAI prowadzi w wykonywaniu poleceń, rozumowaniu na długich dokumentach i pracy z narzędziami (HLE z narzędziami 48,5 wobec 35,8), a wobec GPT-OSS-120B prowadzi niemal wszędzie. Jedyna kolumna, w której wyraźnie przegrywa, to programowanie konkursowe: 1899 punktów Elo na CodeForces wobec 2160 dla GPT-5-mini, 2157 dla GPT-OSS-120B i 2146 dla starszego modelu 235B. Nic innego w tabeli nie odstaje tak daleko, więc to właśnie jest uczciwie postawiona granica tego modelu — zadania z konkursów algorytmicznych nadal są kwestią pojemności. Architektura jest gęsta: 27,78 miliarda parametrów, 64 warstwy ułożone w szesnaście powtórzeń trzech bloków Gated DeltaNet zakończonych blokiem uwagi bramkowanej, wymiar ukryty 5120, wymiar pośredni warstwy w przód 17 408, słownik 248 320 tokenów, przewidywanie wielu tokenów naraz. Kontekst ma natywnie 262 144 tokeny i według Alibaby rozciąga się do 1 010 000. Widzenie jest wbudowane w całą generację, a nie wydzielone do osobnej linii — model przyjmuje obok tekstu obrazy i wideo. Warto odnotować jedną rozbieżność. Własna karta tego modelu podaje na SWE-bench Verified wynik 72,4; tabela porównawcza opublikowana w kwietniu razem z nowszym Qwen3.6-35B-A3B przypisuje temu samemu modelowi 75,0. Alibaba nie tłumaczy tej różnicy, a repozytorium zaktualizowano tego samego dnia, w którym ukazała się nowsza karta — najprawdopodobniej to powtórzony pomiar, a nie sprostowanie, ale czytelnik powinien wiedzieć, że obie liczby pochodzą od producenta i różnią się o 2,6 punktu. Wagi na licencji Apache 2.0, bez dodatkowych ograniczeń.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!