MDL-2182EST.2025 · IDX.516
Model językowyW produkcji

GLM-4.6V

Z.ai (Zhipu AI) · China · 2025

Te same wagi co GLM-4.5V, tylko przetrenowane: dwa razy większy kontekst, o połowę niższa cena i pierwszy wizyjny GLM, który wywołuje narzędzia.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GLM-4.6V, opublikowany w grudniu 2025, to najczystszy w katalogu Z.ai przykład skoku generacyjnego, który nic nie kosztuje po stronie sprzętu. Indeks safetensors na Hugging Face podaje 107 710 933 120 parametrów — co do bajta tyle samo, ile ogłoszono cztery miesiące wcześniej przy GLM-4.5V. Sieci nie powiększono, tylko ją przetrenowano. Zmieniło się wszystko dookoła wag. Okno kontekstu urosło dwukrotnie, z 64 tys. do 128 tys. tokenów, więc komplet dokumentów albo długie nagranie ekranu mieści się w jednym zapytaniu. Po raz pierwszy w wizyjnym GLM-ie pojawiło się natywne wywoływanie funkcji i to właśnie producent wskazuje jako sens tego wydania: domyka lukę między modelem, który widzi ekran, a agentem, który na tym ekranie działa. Cena spadła o połowę — z 0,60 i 1,80 USD za milion tokenów do 0,30 i 0,90 USD. Z.ai sprzedaje trzy warianty. Standardowy opisano wyżej; GLM-4.6V-FlashX to wersja lekka i szybsza, po 0,04 USD za wejście i 0,40 USD za wyjście; GLM-4.6V-Flash jest bezpłatny. Wszystkie trzy przyjmują wideo, obrazy, tekst i pliki i wszystkie mają okno 128 tys. tokenów — to nietypowe, bo dostawcy zwykle skracają kontekst w wariantach darmowych. Wagi leżą na Hugging Face na licencji MIT. Liczba pobrań sięgała 8,4 tys., czyli rząd wielkości mniej niż u poprzednika — zwykłe opóźnienie modelu, który jest w obiegu krócej, a jego poprzednik zdążył się już wszędzie zadomowić.

#open weights#MIT license#vision-language#multimodal agents#128K context
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję