DeepSeek-V4-Flash
DeepSeek · China · 2026
Oszczędny model linii V4 od DeepSeeka — MoE o 284 miliardach parametrów, z czego 13 miliardów aktywnych na token, na licencji MIT z otwartymi wagami.
DeepSeek-V4-Flash to kompaktowy przedstawiciel czwartej generacji modeli DeepSeeka, opublikowany najpierw jako wersja zapoznawcza w kwietniu 2026 razem ze znacznie większym V4-Pro. Jest to rzadki model mixture-of-experts o 284 miliardach parametrów, z czego na token aktywowanych jest około 13 miliardów; obsługuje okno kontekstu miliona tokenów i odpowiedzi o długości do 384 tysięcy tokenów. Raport techniczny opisuje hybrydowy mechanizm uwagi łączący uwagę skompresowaną i hiperpołączeniową, hiperpołączenia z ograniczeniem rozmaitości oraz optymalizator Muon, przy treningu na ponad 32 bilionach tokenów. Model działa wyłącznie na tekście — nie przyjmuje obrazu ani dźwięku. 31 lipca 2026 DeepSeek wydał rewizję 0731: tę samą architekturę po ponownym treningu końcowym, nastawioną na pracę agentową i inżynierię oprogramowania. Przyrosty okazały się nietypowo duże — wynik Terminal-Bench 2.1 wzrósł z 61,8 do 82,7, a DeepSWE z 7,3 do 54,4; niezależne testy Artificial Analysis dały modelowi 50 punktów w Intelligence Index, o dziesięć więcej niż poprzedniej wersji Flash. Wagi są opublikowane na Hugging Face na licencji MIT, a cennik API wynosi 0,14 dolara za milion tokenów wejściowych i 0,28 dolara za milion wyjściowych — to jedna z najniższych stawek dla modelu o takich możliwościach. Wcześniejszy DeepSeek-R1 pozostaje dostępny i ma własny profil w katalogu. Model jest też odsprzedawany przez platformy zewnętrzne, a tam obowiązuje własny cennik. Na BytePlus ModelArk, czyli w usłudze modelowej ByteDance, wersja 0731 rozliczana jest po dawnych stawkach DeepSeeka — 0,14 i 0,28 dolara za milion tokenów — do 21 sierpnia 2026, kiedy przechodzi na 0,44 / 1,32 / 0,014, czyli dokładnie te liczby, które DeepSeek przyjął pięć dni wcześniej. ModelArk nie ma taryfy pozaszczytowej: odpowiednik połowy ceny, 0,22 / 0,66, dostępny jest tam wyłącznie w trybie wsadowym, więc ten sam rabat kupuje się opóźnieniem odpowiedzi, a nie porą doby.
▸Newsy
Chmura ByteDance włączyła podwyżkę DeepSeeka — a starszą wersję tego samego modelu zostawiła po dawnej cenie
21.08.2026 · BytePlus ModelArk — cennik modeli (docs.byteplus.com), stan na 21.08.2026
Podwyżka DeepSeeka dociera do chmury konkurenta pięć dni później — a rabat kosztuje tam co innego
16.08.2026 · BytePlus ModelArk — Pricing
Najtańsze laboratorium przestaje być tanie: DeepSeek podnosi ceny API od 16 sierpnia i zaczyna liczyć według zegara
15.08.2026 · DeepSeek — dokumentacja API (cennik)
Aktualizacja 0731 modelu DeepSeek V4-Flash mocno podnosi wyniki w kodowaniu agentowym
31.07.2026 · Artificial Analysis
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!