MDL-5704EST.2025 · IDX.249
Model językowyW produkcji

Qwen3-30B-A3B-Instruct-2507

Alibaba Cloud · China · 2025

Lipcowe odświeżenie małego modelu MoE Alibaby: przełącznik trybu myślenia znika, kontekst rośnie ośmiokrotnie, a wyniki testów skaczą o dziesiątki punktów.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Trzy miesiące po kwietniowej premierze Qwen3-30B-A3B Alibaba wydała odświeżony model pod bardzo podobną nazwą — i z inną decyzją projektową w tle. Pierwowzór miał jeden komplet wag, który dawało się przełączać między trybem myślenia a trybem bezpośrednim. To wydanie rezygnuje z przełącznika: pracuje wyłącznie w trybie bezpośrednim i w ogóle nie wypisuje już bloków rozumowania. Osobne wydanie rozumujące wyszło w sierpniu, więc rodzina, która zaczynała od jednego modelu hybrydowego, skończyła lato z dwoma wyspecjalizowanymi. Budowa sieci się nie zmieniła: 30,5 mld parametrów, 128 ekspertów na 48 warstwach, ośmiu wybieranych na token, czyli około 3,3 mld aktywnych. Zmieniło się trenowanie i kontekst. Okno rośnie z 32 768 tokenów natywnie do 262 144 — osiem razy więcej, bez obejścia YaRN, którego model kwietniowy potrzebował do długich wejść. Firmowa tabela porównawcza pokazuje, ile dało to przetrenowanie w zestawieniu z modelem kwietniowym w trybie bezpośrednim: AIME25 rośnie z 21,6 do 61,3, Arena-Hard v2 z 24,8 do 69,0, GPQA z 54,8 do 70,4, a MMLU-Pro z 69,1 do 78,4. To liczby podane przez producenta, a każdy z tych testów mierzy co innego — ale kierunek jest w nich wszystkich taki sam. Wagi pozostają na licencji Apache 2.0, z użyciem komercyjnym włącznie; repozytorium notuje około 780 tys. pobrań w trzydzieści dni.

#open weights#MoE#long context#multilingual
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję