GLM-4-32B-0414
Z.ai (Zhipu AI) · China · 2025
Model o 32 mld parametrów, który trzyma dno cennika Z.ai: dziesięć centów za milion tokenów, tak samo na wejściu i na wyjściu.
GLM-4-32B-0414 to model, który otworzył kwietniową falę premier Z.ai w 2025 roku i półtora roku później nadal zajmuje w cenniku firmy konkretne miejsce: najtańszego płatnego modelu tekstowego, po 0,10 USD za milion tokenów. Stawka jest identyczna na wejściu i na wyjściu, co jest nietypowe — każdy inny płatny model w tym cenniku liczy sobie za to, co napisze, trzy do czterech razy więcej niż za to, co przeczyta. Model wytrenowano wstępnie na 15 bilionach tokenów z dużym udziałem syntetycznych danych rozumowych, a deklarowanym celem była praca inżynierska: pisanie kodu, wywoływanie funkcji, odpowiadanie na pytania z wyszukiwarką i tworzenie raportów. Producent twierdził, że w części tych testów dorównuje modelom o rząd wielkości większym, w tym DeepSeekowi V3. Dał też początek całej rodzinie. Na tej samej bazie powstały GLM-Z1-32B-0414, wariant rozumujący, oraz GLM-Z1-Rumination-32B-0414, model do długich zadań badawczych, który potrafi sięgnąć po wyszukiwarkę w trakcie myślenia — wczesna odpowiedź na produkty typu deep research. Ta gałąź zdążyła się już wchłonąć: do 2026 roku Z.ai, jak większość konkurencji, przestała wydawać rozumowanie jako osobny produkt i zrobiła z niego ustawienie w modelu głównym. Jeden szczegół warto sprawdzić przed wdrożeniem. Cennik sprzedaje ten model jako GLM-4-32B-0414-128K, ale plik konfiguracyjny dołączony do otwartych wag ustawia okno kontekstu na 32 768 tokenów, a przypisy do testów w karcie modelu mówią o 32K jako granicy, o ile nie zastosuje się rozszerzenia YaRN. Hostowane 128K opisuje więc rozszerzoną konfigurację serwowania, a nie to, co pobrane wagi robią same z siebie.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!