GLM-4.6V-Flash
Z.ai (Zhipu AI) · China · 2025
Mały bliźniak wizyjnego flagowca Z.ai: dziesięć razy mniej parametrów, darmowy w API i pobierany dwadzieścia razy częściej.
GLM-4.6V-Flash to mniejszy z pary modeli wizyjnych, którą Z.ai opublikowała 7 grudnia 2025 roku. Oba wyszły tego samego dnia, oba na licencji MIT i oba może pobrać każdy. Różni je rozmiar: flagowy GLM-4.6V ma 107,7 mld parametrów, ten — 10,3 mld. Ta różnica rozstrzyga, kto naprawdę może z nich skorzystać, i widać to po licznikach pobrań. W oknie trzydziestu dni mniejszy model ściągnięto około 82 600 razy, flagowca około 4000 — dwadzieścia razy rzadziej, choć pobranie żadnego z nich nic nie kosztuje. Powodem jest sprzęt, nie cena: 10 mld parametrów mieści się na jednej karcie, a skompresowane wersje społecznościowe tego modelu chodzą na laptopie, podczas gdy 107 mld wymaga serwera. Który model jest technicznie lepszy, to osobna sprawa — w zasięgu pobierających jest tylko jeden. W API ten sam model jest rozliczany na zero. Z.ai utrzymuje dokładnie trzy darmowe poziomy tekstowe — ten, GLM-4.5-Flash i GLM-4.7-Flash — a płatną linię wizyjną wycenia powyżej: GLM-4.6V kosztuje 0,30 USD za milion tokenów wejścia. Zakres techniczny nie jest wersją okrojoną. Okno kontekstu ma 131 072 tokeny, czyli tego samego rzędu co modele płatne, a enkoder wizyjny to pełny stos 24 warstw przy wejściu 336 pikseli z podziałem czasowym — model czyta więc klatki nagrania, nie tylko nieruchome zdjęcia. Strona tekstowa to gęsty stos 40 warstw o szerokości 4096, na zwyczajowym dla Z.ai słowniku 151 552 tokenów.
▸Newsy
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!