MDL-7034EST.2025 · IDX.580
Model językowyW produkcji

GLM-Z1-32B-0414

Z.ai (Zhipu AI) · China · 2025

Pierwszy osobny model rozumujący Z.ai: kwietniowa baza 32 mld parametrów douczona uczeniem ze wzmocnieniem do myślenia na głos — dziś dostępna wyłącznie do pobrania, nie z API producenta.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GLM-Z1-32B-0414 to rozumująca gałąź kwietniowej fali premier Z.ai z 2025 roku. Szkielet ma dokładnie taki sam jak GLM-4-32B-0414 — 61 warstw, wymiar ukryty 6144, 48 głów uwagi przy 2 głowach klucz-wartość — a wszystko, co dzieli oba modele, wydarzyło się po wstępnym treningu: zimny start na długich łańcuchach myśli, potem rozbudowane uczenie ze wzmocnieniem na matematyce, kodzie i logice, a na koniec runda ogólnego uczenia ze wzmocnieniem sterowana porównywaniem par odpowiedzi. Model nie decyduje, czy ma myśleć. Jego szablon rozmowy dokleja znacznik myślenia do pierwszej linii każdego zapytania, więc namysł jest wymuszony, a nie opcjonalny; producent zaleca przy tym, żeby przed kolejną turą usuwać ukryte rozumowanie z historii rozmowy. Zalecany limit generacji to 30 000 nowych tokenów — ustawiony tak wysoko celowo, żeby starczyło miejsca na myślenie, którego użytkownik nigdy nie zobaczy. To pożyteczna liczba dla każdego, kto liczy koszt wnioskowania: widoczna odpowiedź jest ułamkiem tego, co model naprawdę wygeneruje. Kontekst jest jedynym miejscem, w którym model jest mniejszy niż jego reputacja. Opublikowane wagi ustawiają okno na 32 768 tokenów, a producent sam radzi włączać rozszerzenie YaRN, gdy wejście przekroczy 8192 tokeny — to obejście z udokumentowanym kosztem na krótkich tekstach, a nie natywnie długi kontekst. Dwie rzeczy trzeba powiedzieć wprost. Po pierwsze, w tym profilu nie ma ani jednego wyniku testu, bo Z.ai opublikowała rezultaty modelu wyłącznie jako obrazki z wykresami, bez liczb; nie ma czego cytować, co nie byłoby odczytem ze słupka. Po drugie, GLM-Z1-32B-0414 nie występuje w aktualnym cenniku firmy — bliźniacza baza wciąż jest sprzedawana po dziesięć centów za milion tokenów, ale wariant rozumujący jest dziś wyłącznie plikiem do pobrania. To widoczny ślad szerszej zmiany: do 2026 roku Z.ai, jak większość konkurencji, wchłonęła rozumowanie do modeli głównych jako ustawienie, zamiast wydawać je osobnym produktem. Gałąź żyje jednak poza API — ponad 22 tysiące pobrań miesięcznie półtora roku po premierze. Ta sama fala dała dwóch krewnych: GLM-Z1-Rumination-32B-0414, który myśli znacznie dłużej i potrafi sięgnąć po wyszukiwarkę w trakcie namysłu, oraz mały GLM-Z1-9B-0414.

#open weights#MIT license#reasoning#32B#no hosted tier
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję