Wszystkie newsyBiznes

Z.ai nie podaje, jak duże są jego modele — podają to pliki wag: piąta generacja jest dwa razy większa od czwartej

Opublikowano: 21.08.2026 · Źródło: Z.AI Developer Documentation

Z.ai opisuje na jednej stronie cennika piętnaście modeli tekstowych i sześć wizyjnych, i żadnego z nich nie charakteryzuje rozmiarem. Karty modeli podają okno kontekstu, limit odpowiedzi, modalności i funkcje; liczby parametrów — szczegółu, od którego zaczyna się każde porównanie — po prostu nie ma. Prasa wypełnia tę lukę danymi, których firma nigdy nie potwierdziła. Nie musi tak być, bo Z.ai udostępnia wagi. Indeks plików safetensors każdego otwartego modelu podaje sumę dokładnie: GLM-4.6 (wrzesień 2025) i GLM-4.7 (grudzień 2025) to 356,8 i 358,3 mld parametrów, oba zbudowane z 92 warstw, ze 160 ekspertami routowanymi i jednym współdzielonym, z ośmioma aktywnymi na token. Piąta generacja to podwaja. GLM-5, GLM-5.1 i GLM-5.2 mają po około 753 mld parametrów w 78 warstwach, z 256 ekspertami routowanymi i jednym współdzielonym — ten sam szkielet użyty trzy razy, od lutego do czerwca 2026. Cennik dzieli się tak samo. Oba modele czwartej generacji kosztują 0,60 USD za milion tokenów wejścia i 2,20 USD za milion wyjścia, a linia schodzi jeszcze do GLM-4.7-FlashX po 0,07/0,40 USD i do bezpłatnego GLM-4.7-Flash. Piąta generacja zaczyna się od 1,00/3,20 USD za GLM-5 i zatrzymuje na 1,40/4,40 USD dla GLM-5.1, GLM-5.2 i GLM-5.3 — czyli 2,3 raza drożej niż czwarta generacja przy 2,1 raza większej sieci. Jeden model wyłamuje się ze schematu i warto to odnotować: GLM-5V-Turbo, wizyjno-programistyczny model z kwietnia 2026, nie ma opublikowanych wag w ogóle. Z.ai powtarza, że osiąga swoje wyniki „przy mniejszym rozmiarze modelu” — i akurat tej jednej deklaracji w całej rodzinie nie da się dziś zestawić z plikiem.