MDL-6804EST.2026 · IDX.971
Model językowyW produkcji

GLM-4.7-Flash

Z.ai (Zhipu AI) · China · 2026

Darmowy model Z.ai: 31 miliardów parametrów, licencja MIT, kontekst 200 tysięcy tokenów — i mniej więcej 29 razy więcej pobrań niż flagowiec, z którego go odchudzono.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GLM-4.7-Flash wyszedł 19 stycznia 2026 roku jako darmowy towarzysz modelu GLM-4.7, który miesiąc wcześniej zamknął u Z.ai generację GLM-4. To model typu mieszanka ekspertów o 31,2 miliarda parametrów łącznie: 47 warstw, 64 ekspertów rutowanych plus jeden współdzielony, z czego cztery aktywne na token, oraz okno kontekstu 202 752 tokenów. Wagi leżą na Hugging Face na licencji MIT, a wywołania przez API Z.ai nie kosztują nic — wejście, wyjście i wejście z pamięci podręcznej są w cenniku oznaczone jako darmowe. Ciekawą liczbą nie jest tu wynik testu, tylko licznik pobrań. W oknie trzydziestu dni GLM-4.7-Flash pobrano około 1,88 miliona razy, wobec mniej więcej 65 tysięcy pobrań pełnego GLM-4.7, z którego pochodzi — czyli około dwudziestu dziewięciu razy więcej. Częściej pobierany jest w tej firmie tylko model do rozpoznawania dokumentów. To najczystszy dowód w katalogu Z.ai na prawidłowość, którą cały rynek otwartych wag pokazuje raz za razem: o przyjęciu decyduje to, czy plik mieści się na sprzęcie, który ktoś już ma, a nie miejsce modelu w tabeli wyników. Przy 31 miliardach parametrów i czterech ekspertach aktywnych na token model jest dostatecznie mały, żeby obsłużyć go z jednej porządnie wyposażonej maszyny, a Z.ai ustawia go do pracy, w której liczy się przepustowość, nie szczytowa jakość: częste podpowiadanie kodu, pisanie szkiców, tłumaczenia, dłuższe teksty i odgrywanie ról, wszystko przy małych opóźnieniach. Producent określa go jako konkurencyjny w kodowaniu w swojej skali — to ostrożne sformułowanie i słusznie, bo nic tutaj nie zagraża flagowcowi o 358 miliardach parametrów w trudnym rozumowaniu. Praktyczny wniosek warto postawić wprost dla każdego, kto wybiera między tymi dwoma. GLM-4.7 kosztuje 0,60 USD za milion tokenów wejścia i 2,20 USD za milion wyjścia. GLM-4.7-Flash nie kosztuje przez to samo API nic, zachowuje w zasadzie to samo okno kontekstu i dodatkowo można go pobrać i uruchomić u siebie. Flagowiec zarabia na swoją cenę przy najtrudniejszych zadaniach; do całej reszty rynek wybrał model darmowy.

#open weights#mixture of experts#free tier#coding
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję