MDL-9623EST.2026 · IDX.208
Model językowyW produkcji

DeepSeek-V4-Pro

DeepSeek · China · 2026

Flagowiec DeepSeeka — MoE o 1,6 biliona parametrów z otwartymi wagami na licencji MIT, dorównujący zamkniętym modelom czołowym w kodowaniu za ułamek ich ceny.

Ocena wujec.ai

9.0/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

DeepSeek-V4-Pro to flagowy model czwartej generacji DeepSeeka i większy z dwóch wariantów linii V4, które firma wydała. Jest to rzadki model mixture-of-experts o 1,6 biliona parametrów, z czego na token aktywowanych jest około 49 miliardów; okno kontekstu — milion tokenów — dzieli z mniejszym V4-Flash. Podobnie jak reszta linii działa wyłącznie na tekście: bez wejścia obrazowego, dźwiękowego czy wideo. Model opublikowano najpierw jako wersję zapoznawczą 24 kwietnia 2026, a pełną dostępność (GA) osiągnął 19 lipca 2026. Między tymi datami wagi się nie zmieniły — zmieniła się otoczka handlowa. DeepSeek po raz pierwszy wprowadził taryfę szczytową, podwajającą stawki w godzinach pracy w Pekinie, a 24 lipca 2026 wycofał stare punkty końcowe API deepseek-chat i deepseek-reasoner, zmuszając klientów do przejścia na jawne identyfikatory modeli. Według danych opublikowanych przez DeepSeeka przy premierze GA V4-Pro uzyskuje 80,6% w SWE-bench Verified — najlepszy wynik wśród modeli z otwartymi wagami — a także rating 3206 w Codeforces, 57,9% w SimpleQA Verified i 37,7% w Humanity's Last Exam. Pomiar niezależny wypada mniej korzystnie: Artificial Analysis przyznał V4-Pro 44 punkty w Intelligence Index w momencie GA wobec 52 przy premierze zapoznawczej — nie dlatego, że model się pogorszył, lecz dlatego, że przez trzy miesiące przesunęła się czołówka. Prawdziwym argumentem jest ekonomia. Cennik API poza szczytem to 0,435 dolara za milion tokenów wejściowych i 0,87 za milion wyjściowych, a wejście z pamięci podręcznej kosztuje około setnej części tej stawki — o rząd wielkości mniej niż zachodnie modele czołowe o porównywalnych umiejętnościach programistycznych. Wagi są dostępne na Hugging Face na licencji MIT, więc model można też uruchomić w całości u siebie. DeepSeek-V4-Flash i wcześniejszy DeepSeek-R1 pozostają dostępne i mają w katalogu własne profile.

#MoE#open weights#MIT license#long context#agentic coding#frontier#China
Strona oficjalna

Newsy

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję