LLaDA2.1-mini
InclusionAI (Ant Group) · China · 2026
Model dyfuzyjny o otwartych wagach i 16 mld parametrów, który potrafi wrócić i poprawić raz napisane tokeny — kosztem około dwukrotnie szybszego pisania i nieco słabszego wyniku.
LLaDA2.1-mini to następca modelu LLaDA2.0-mini z linii dyfuzyjnej, którą InclusionAI, otwartoźródłowe ramię grupy Ant, prowadzi obok zwykłych modeli Ling. Wagi udostępniono 9 lutego 2026 r. na licencji Apache 2.0. Architektura nie zmieniła się względem poprzednika: dyfuzyjna mieszanka ekspertów o 16,26 miliarda parametrów w BF16, 256 ekspertów routowanych, z których na token używanych jest 8, plus jeden wspólny, 20 warstw, słownik 157 184 tokenów i okno kontekstu 32 768 tokenów. Zmienił się trening i sposób próbkowania — i dotyka to strukturalnej słabości dyfuzyjnego pisania tekstu. Model autoregresyjny zatwierdza każdy token po kolei; model dyfuzyjny odsłania cały blok naraz, co jest szybsze, ale nie zostawia sposobu na poprawienie tokenu, który okazał się zły, gdy sąsiednie są już wypełnione. Ta wersja potrafi edytować raz odsłonięte tokeny w kolejnych przebiegach odszumiania — producent nazywa to generacją edytowalną z korekcją błędów, a tytuł jego publikacji brzmi „Przyspieszanie dyfuzji tekstu przez edycję tokenów”. Model wydano w dwóch trybach próbkowania, a nie w dwóch zestawach wag. Tryb szybki osiąga średnio 5,34 tokenu na przebieg sieci wobec 2,60 u LLaDA2.0-mini — nieco ponad dwa razy więcej — przy średnim wyniku spadającym z 63,39 do 62,07. Tryb jakościowy daje 3,12 tokenu na przebieg i 63,90, jest więc zarazem szybszy i minimalnie lepszy od starszego modelu. Przyspieszenie jest bardzo nierówne w zależności od zadania: w teście kodu HumanEval+ tryb szybki sięga 12,32 tokenu na przebieg wobec 5,16 u poprzednika, ale w chińskim teście wiedzy C-EVAL już tylko 3,39 wobec 1,78. Kod, z jego przewidywalną strukturą, jest tym, na czym równoległe odsłanianie zarabia; otwarte pytania o wiedzę tym, na czym nie. Jedno porównanie we własnej tabeli wydawcy warto przeczytać uważnie. Ling-mini-2.0, zwykły model autoregresyjny tej samej firmy i tej samej klasy wielkości, ma średnią 64,72 — powyżej obu trybów dyfuzyjnych. Wynika z tego, że linia dyfuzyjna nie jest sprzedawana jako technika sprawniejsza, tylko jako szybsza, a producent sam drukuje liczby, które to mówią. Wszystkie wyniki testów pochodzą od wydawcy. Licencję podano jako Apache 2.0 zarówno w treści karty, jak i w metadanych, ale tak jak przy każdym innym wydaniu tego producenta w repozytorium nie ma żadnego pliku licencji — 17 plików i ani jednego z jej treścią. Liczba pobrań to około 101 tysięcy w ostatnich 30 dniach, czyli mniej więcej połowa z 201 tysięcy odnotowanych w tym samym okresie dla starszego LLaDA2.0-mini.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!