MDL-5461EST.2026 · IDX.411
Model językowyW produkcji

Qwen3.8-Flash-Next

Alibaba Cloud · China · 2026

Alibaba nazywa go eksperymentalną zapowiedzią architektury Qwen4: 180 miliardów parametrów, z których nad jednym tokenem pracuje tylko 6 miliardów, i licencja, która nie jest w pełni otwarta — sprzedaż modelu jako usługi wymaga osobnej umowy z Qwenem.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Qwen3.8-Flash-Next to publiczna zapowiedź architektury, na której Alibaba zamierza oprzeć kolejne pokolenie swoich modeli. Wagi trafiły na Hugging Face 24 sierpnia 2026, a wersja hostowana, sprzedawana jako Qwen3.8-Flash, pojawiła się dwa dni później. Opublikowany indeks wag sumuje się do 180,0 miliarda parametrów, a karta modelu tłumaczy, jak się dzielą: 125 miliardów w modelu językowym, z czego 6 miliardów aktywnych na token, do tego 51 miliardów w osadzeniach n-gramowych i 4 miliardy na przewidywanie wielu tokenów naraz. Mieszanka ekspertów liczy 512 pozycji, z których naraz pracuje dziesięć wybranych i jedna wspólna. Uwaga jest hybrydowa — Gated DeltaNet w parze z rzadką uwagą QSA, która wybiera całe mikrobloki zamiast pojedynczych tokenów, i to właśnie ten wybór, jak podaje Alibaba, skraca czas odpowiedzi przy długich wejściach. Model jest multimodalny z założenia: to model językowy z dołączonym enkoderem wizyjnym, przyjmujący tekst, obrazy i wideo. Natywny kontekst wynosi 262 144 tokeny i daje się rozciągnąć do miliona metodą YaRN, przed czym producent uczciwie ostrzega, bo pogarsza to jakość przy krótkich wejściach; hostowany Qwen3.8-Flash pracuje na milionie domyślnie i kosztuje 0,15 dolara za milion tokenów wejścia oraz 0,47 dolara za milion wyjścia. Osobnej uwagi wymaga licencja, bo model bywa opisywany po prostu jako otwarty. Qwen Community License 1.0 pozwala na użytek komercyjny, hosting i dotrenowanie, ale stawia dwa warunki: produkt z ponad 100 milionami użytkowników miesięcznie lub 20 milionami dolarów miesięcznego przychodu musi pokazywać nazwę modelu w interfejsie, a każdy, kto chce sprzedawać model jako usługę albo zbudować na nim asystenta do programowania lub pracy biurowej, musi najpierw uzyskać od Qwena osobną licencję. Użytek wewnętrzny firmy jest z tego wyłączony. To są otwarte wagi, ale nie otwarta licencja w rozumieniu Apache czy MIT.

#open weights#multimodal#long context#MoE#Qwen4 preview
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję