LLaDA2.0-mini
InclusionAI (Ant Group) · China · 2025
Model dyfuzyjny o otwartych wagach i 16 mld parametrów, który pisze tekst blokami po 32 tokeny zamiast token po tokenie — i najczęściej pobierany model tego wydawcy w historii.
LLaDA2.0-mini to mały przedstawiciel linii dyfuzyjnej InclusionAI, otwartoźródłowego ramienia grupy Ant, i pod względem liczby pobrań najbardziej udane wydanie tego producenta w ogóle: ponad 1,01 miliona pobrań od chwili udostępnienia wag 25 listopada 2025 r., wobec 7,2 tysiąca dla bilionowego flagowca rozumującego tej samej firmy. Od niemal wszystkiego innego w tym katalogu odróżnia go sposób, w jaki tworzy tekst. Zwykłe modele językowe są autoregresyjne: wypisują jeden token, patrzą na niego i wypisują następny. Ten jest modelem dyfuzyjnym — zaczyna od zamaskowanego bloku i odsłania go w kolejnych przebiegach doprecyzowujących. Zalecane przez producenta ustawienia generują blokami po 32 tokeny w 32 krokach odszumiania, przy temperaturze 0; podniesienie temperatury, jak ostrzega, potrafi skłonić model do mieszania języków. Wagi to mieszanka ekspertów. Opublikowany indeks plików wag liczy 16,26 miliarda parametrów w BF16, z czego około 1,4 miliarda jest aktywnych na token — 256 ekspertów routowanych, z których wybieranych jest 8, plus jeden ekspert wspólny, w 20 warstwach, przy rozmiarze ukrytym 2048 i słowniku 157 184 tokenów. Okno kontekstu wynosi 32 768 tokenów. Ten rozmiar jest tu sednem sprawy: model powstał z myślą o pracy na pojedynczym zwykłym akceleratorze, a nie na szafie serwerowej. Nie trenowano go od zera. InclusionAI kontynuowało trening na własnej bazie Ling 2.0 na mniej więcej 20 bilionach tokenów, a potem dostroiło wynik do instrukcji własnym narzędziem dFactory. We własnej tabeli producenta model osiąga średnią 71,67 wobec 70,19 dla Qwen3-8B bez trybu rozumowania, a w poszczególnych testach 80,53 w MMLU, 47,98 w GPQA, 93,22 w MATH i 86,59 w HumanEval; w AIME 2025 sięga 36,67, czyli wyraźnie mniej niż modele rozumujące z tej samej stajni. Wszystkie te liczby pochodzą od wydawcy. Sytuacja licencyjna jest czystsza niż przy pozostałych modelach tego producenta: karta wskazuje Apache 2.0 zarówno w tekście, jak i w metadanych, choć w repozytorium wciąż nie ma osobnego pliku licencji wśród 16 plików. Linia miała dalszy ciąg — LLaDA2.0-flash to większe rodzeństwo, a LLaDA2.1-mini ukazał się 9 lutego 2026 r. — a mimo to starsze wydanie jest wciąż pobierane około dwa razy częściej niż jego następca.
▸Newsy
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!