DeepSeek-V4-Pro
DeepSeek · China · 2026
Flagowiec DeepSeeka — MoE o 1,65 biliona parametrów z otwartymi wagami na licencji MIT; finalne wydanie 0813 wynosi kodowanie agentowe do czołówki za ułamek ceny modeli zamkniętych.
DeepSeek-V4-Pro to flagowy model czwartej generacji DeepSeeka i większy z dwóch wariantów linii V4, które firma wydała. Jest to rzadki model mixture-of-experts o 1,6 biliona parametrów, z czego na token aktywowanych jest około 49 miliardów; okno kontekstu — milion tokenów — dzieli z mniejszym V4-Flash. Podobnie jak reszta linii działa wyłącznie na tekście: bez wejścia obrazowego, dźwiękowego czy wideo. Model opublikowano najpierw jako wersję zapoznawczą 24 kwietnia 2026, a pełną dostępność (GA) osiągnął 19 lipca 2026. Między tymi datami wagi się nie zmieniły — zmieniła się otoczka handlowa. DeepSeek po raz pierwszy wprowadził taryfę szczytową, podwajającą stawki w godzinach pracy w Pekinie, a 24 lipca 2026 wycofał stare punkty końcowe API deepseek-chat i deepseek-reasoner, zmuszając klientów do przejścia na jawne identyfikatory modeli. Według danych opublikowanych przez DeepSeeka przy premierze GA V4-Pro uzyskuje 80,6% w SWE-bench Verified — najlepszy wynik wśród modeli z otwartymi wagami — a także rating 3206 w Codeforces, 57,9% w SimpleQA Verified i 37,7% w Humanity's Last Exam. Pomiar niezależny wypada mniej korzystnie: Artificial Analysis przyznał V4-Pro 44 punkty w Intelligence Index w momencie GA wobec 52 przy premierze zapoznawczej — nie dlatego, że model się pogorszył, lecz dlatego, że przez trzy miesiące przesunęła się czołówka. Prawdziwym argumentem jest ekonomia. Cennik API poza szczytem to 0,435 dolara za milion tokenów wejściowych i 0,87 za milion wyjściowych, a wejście z pamięci podręcznej kosztuje około setnej części tej stawki — o rząd wielkości mniej niż zachodnie modele czołowe o porównywalnych umiejętnościach programistycznych. Wagi są dostępne na Hugging Face na licencji MIT, więc model można też uruchomić w całości u siebie. DeepSeek-V4-Flash i wcześniejszy DeepSeek-R1 pozostają dostępne i mają w katalogu własne profile. 13 sierpnia 2026 DeepSeek opublikował model DeepSeek-V4-Pro-0813 i opisał go jako oficjalne wydanie V4-Pro, zastępujące wagi zapoznawcze noszące tę nazwę od kwietnia. Architektura się nie zmieniła, ale dołączono moduł spekulatywnego dekodowania DSpark, a sterowanie rozumowaniem (reasoning_effort) ma teraz poziomy low, high i max. Poprawa raportowana przez firmę dotyczy niemal wyłącznie zadań agentowych i programistycznych: DeepSWE rośnie z 12,8% do 62,7%, NL2Repo z 38,5% do 61,5%, Cybergym z 52,7% do 83,3%, a Terminal Bench 2.1 z 72,1 do 87,9. Wydanie rezygnuje też z szablonu rozmowy w formacie Jinja na rzecz udokumentowanego kodera w Pythonie, co oznacza pracę dla każdego, kto uruchamia wagi lokalnie. Podane liczby pochodzą od producenta.
▸Newsy
Najczęściej pobierany model DeepSeeka ma 19 miesięcy — najnowsze wydanie flagowca ściąga się 32 razy rzadziej dziennie
25.08.2026 · Hugging Face (model repositories)
Zegar DeepSeeka jest pekiński: ten sam dzień pracy kosztuje tam 75% więcej niż w San Francisco
19.08.2026 · DeepSeek — dokumentacja API (Models & Pricing)
DeepSeek wydaje finalne V4-Pro: otwarte wagi, milion tokenów kontekstu i skok w zadaniach agentowych
13.08.2026 · DeepSeek (Hugging Face model card)
Flagowy model DeepSeeka o 1,6 biliona parametrów wchodzi do pełnej dostępności — i zaczyna liczyć według zegara
19.07.2026 · AIToolsReview
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!