MiniMax M3
MiniMax · China · 2026
Model MoE z otwartymi wagami, zbudowany wokół nowego mechanizmu uwagi rozproszonej, który czyni milion tokenów kontekstu opłacalnym.
MiniMax M3, wydany 31 maja 2026, to flagowy model językowy szanghajskiego laboratorium i jego teza, że długi kontekst należy traktować jako wymiar do skalowania, a nie jako liczbę do reklamy. Jego sercem jest MSA (MiniMax Sparse Attention) — własna architektura uwagi, która omija kwadratowy koszt pełnej uwagi, dzieląc pamięć klucz-wartość na bloki i zbierając tylko te zapytania, które w dany blok trafiają. Producent podaje, że przy kontekście miliona tokenów koszt obliczeniowy na token wynosi jedną dwudziestą tego, co w poprzedniej generacji, a wstępne przetwarzanie jest ponad dziewięć razy szybsze — istotne jest tu więc nie samo istnienie okna, ale to, że jego wypełnienie przestaje być rujnujące. Model jest natywnie multimodalny: obok tekstu przyjmuje obrazy i wideo, a producent kieruje go do obsługi komputera i pracy agentowej, nie tylko do rozmowy. Architektonicznie to mieszanka ekspertów o łącznie około 427 miliardach parametrów w 60 warstwach, z czterema aktywnymi ekspertami ze 128 na token i maksymalną liczbą pozycji 1 048 576. W parze z modelem idzie MiniMax Code — środowisko agentowe trenowane razem z nim, oparte na otwartych projektach OpenCode i Pi. Wagi opublikowano na Hugging Face na własnej licencji modelowej MiniMaxa. W API firmy rozliczenie zależy od długości wejścia: wywołania do 512 tys. tokenów wejściowych są w stawce podstawowej, dłuższe w dwukrotnie wyższej, przy stałej zniżce 50 procent, która daje 0,30 dolara za milion tokenów wejściowych i 1,20 dolara za milion wyjściowych. Abonamenty od 20 do 120 dolarów miesięcznie zawierają miliardowe pule tokenów, wspólne dla modeli tekstowych, obrazowych, mowy i muzyki MiniMaxa.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!