Newsy

Co słychać w robotyce i AI — wybór redakcji wujec.ai.

Biznes19.08.2026 · DeepSeek — dokumentacja API (Models & Pricing)

Zegar DeepSeeka jest pekiński: ten sam dzień pracy kosztuje tam 75% więcej niż w San Francisco

Cennik DeepSeeka, obowiązujący od 16 sierpnia 2026, jest pierwszym u dużego dostawcy modeli, w którym godzina doby jest pełnoprawnym elementem taryfy, a nie promocją: szczyt to 01:00–04:00 i 06:00–10:00 czasu UTC, a wszystko poza nim kosztuje dokładnie połowę. Opublikowane okna nie mówią nic o tym, gdzie te godziny wypadają. Po przeliczeniu mówią bardzo dużo. Pekin trzyma UTC+8 przez cały rok, bez czasu letniego. Oba okna szczytu wypadają lokalnie na 09:00–12:00 i 14:00–18:00 — czyli w chińskich godzinach pracy. Przerwa między nimi, 04:00–06:00 UTC, to 12:00–14:00 w Pekinie: pora obiadowa, wyceniona po połowie stawki. Dokumentacja nigdzie nie opisuje taryfy w kategoriach geograficznych, ale jest ona obrysowana wokół dnia pracy jednego kraju. Ma to arytmetyczny skutek, którego nikt nie policzył. Weźmy zespół korzystający z DeepSeek-V4-Pro równomiernie przez dzień pracy 09:00–17:00 czasu lokalnego i wyceńmy milion tokenów wyjściowych (3,96 dolara w szczycie, 1,98 poza nim). W San Francisco dzień pracy przypada na 16:00–24:00 UTC i mija się z oboma oknami szczytu, więc każda godzina liczy się po 1,98 dolara. W Warszawie to 07:00–15:00 UTC, z czego trzy godziny są w szczycie: 2,72 dolara za milion, o 37,5% więcej niż w San Francisco. W Pekinie to 01:00–09:00 UTC, z czego w szczycie jest sześć godzin: 3,47 dolara za milion — o 75% więcej niż w San Francisco, za identyczną pracę na identycznych wagach. Bangalur wypada pośrodku: 3,09 dolara, czyli o 56% drożej. Europejskie rachunki ruszają się także wraz ze zmianą czasu. Zimą Warszawa przechodzi na UTC+1, w szczycie zostają tylko dwie godziny pracy, a ten sam milion tanieje do 2,48 dolara — dziewięcioprocentowa zniżka wynikająca wyłącznie z końca czasu letniego. Czego to nie dowodzi: DeepSeek nie liczy nikomu według miejsca. Taryfa jest na całym świecie identyczna i zależna od czasu, a firma przedstawia ją jako zarządzanie obciążeniem — okna szczytu to po prostu godziny, w których jej serwery są najbardziej zajęte, czyli te, w których pracuje jej rodzimy rynek. Zadania wsadowe i nocne może przesunąć w tanie godziny każdy i wszędzie, a w większości wdrożeń produkcyjnych dużo bardziej niż zegar liczy się wejście z pamięci podręcznej, rozliczane po pięćdziesiątej części stawki za brak trafienia. Powyższe liczby zakładają też użycie rozłożone równo na godziny pracy, czego żaden prawdziwy zespół nie robi dokładnie. Kierunek nie jest jednak artefaktem: im dalej dzień pracy użytkownika leży od pekińskiego, tym mniej kosztuje go podwyżka DeepSeeka.

DeepSeek-V4-Pro
Biznes15.08.2026 · DeepSeek — dokumentacja API (cennik)

Najtańsze laboratorium przestaje być tanie: DeepSeek podnosi ceny API od 16 sierpnia i zaczyna liczyć według zegara

DeepSeek opublikował nowy cennik modeli V4, obowiązujący od 16 sierpnia 2026. Firma, która zbudowała pozycję na tym, że była tańsza od wszystkich, podnosi stawki na całej linii — od 50 procent do ponad 1100 procent, zależnie od modelu, rodzaju tokenów i godziny. Liczby dla DeepSeek-V4-Flash: tokeny wyjściowe drożeją z 0,28 do 1,32 dolara za milion w godzinach szczytu, wejściowe bez trafienia w pamięć podręczną z 0,14 do 0,44, a wejściowe z pamięci podręcznej z 0,0028 do 0,014 dolara — pięciokrotnie. DeepSeek-V4-Pro idzie z 0,87 na 3,96 dolara za milion tokenów wyjściowych w szczycie, a jego wejście z pamięci podręcznej z około 0,0036 na 0,044 dolara za milion: to właśnie z tej jednej pozycji bierze się nagłówkowe 1100 procent, a nie ze stawki podstawowej. Równie ważna jak liczby jest zmiana konstrukcji cennika. Od niedzieli cena zależy od tego, o której wysyłamy zapytanie: szczyt to 01:00–04:00 i 06:00–10:00 czasu UTC, cała reszta doby jest poza szczytem i kosztuje dokładnie połowę. DeepSeek tłumaczy, że chodzi o „rozsądniejszy przydział zasobów" i przesunięcie obciążenia na mniej zatłoczone okna. W praktyce to pierwszy raz, gdy duży dostawca modeli robi z godziny doby pełnoprawny element cennika, a nie promocję. Uderzające jest wyczucie czasu. W tym samym tygodniu, w którym Anthropic odwołał zapowiedzianą 50-procentową podwyżkę Claude Sonnet 5, a Google wyznaczył datę końca obniżki Gemini 3.7 Flash, DeepSeek poszedł w przeciwną stronę — i dalej niż którykolwiek z nich. Wyjście V4-Flash poza szczytem, po 0,66 dolara za milion, wciąż jest tanie jak na zachodnie stawki, ale przewaga, która czyniła DeepSeeka oczywistym wyborem domyślnym, skurczyła się cztero-, pięciokrotnie. Oba modele V4 zachowują okno kontekstu miliona tokenów i maksymalnie 384 tys. tokenów odpowiedzi; bez zmian zostają też limity równoległych zapytań (2500 dla Flash, 500 dla Pro). Cenniki w obu profilach w katalogu zostały już zaktualizowane.

DeepSeek-V4-Flash
Premiery6.08.2026 · OpenAI — API deprecations

Pierwotny GPT-5 ma datę wyłączenia — snapshot z sierpnia 2025 znika 11 grudnia

Na stronie deprecacji OpenAI pojawił się wpis, który rok temu trudno byłoby sobie wyobrazić: gpt-5-2025-08-07, czyli snapshot, którym zadebiutował GPT-5, zostanie wyłączony 11 grudnia 2026. Tego samego dnia znika model rozumowania o3-2025-04-16. Oba mają jeden wskazany zamiennik — gpt-5.6-sol. Pierwotny GPT-5 przeżyje więc w API około szesnastu miesięcy. Jak na dzisiejsze standardy to nic nadzwyczajnego, ale liczba robi wrażenie przy modelu, który przy premierze traktowano jako cezurę pokoleniową. Pokazuje też tempo nazewnictwa: w czasie, w którym GPT-4 był modelem domyślnym, zdążyło wyjść pięć wydań pośrednich. Bliższy termin już obowiązuje. Aliasy gpt-5.2-chat-latest i gpt-5.3-chat-latest przestaną odpowiadać 10 sierpnia 2026, czyli za cztery dni — również z przekierowaniem do gpt-5.6-sol. Kto nadal wywołuje nazwy z końcówką -chat-latest, praktycznie nie ma już okna na migrację. Reszta jesiennego kalendarza jest gęsta. Assistants API zostaje usunięte 26 sierpnia, rok po ogłoszeniu zastąpienia go przez Responses API i Conversations API. Sora 2, sora-2-pro oraz Videos API kończą 24 września — bez wskazanego następcy, jako jedyna pozycja na liście, przy której OpenAI nie podaje zamiennika. Starsze rodziny realtime i audio dotrwają do 20 stycznia 2027. Strona konsumencka ma własny, wcześniejszy termin, ogłoszony 28 maja 2026: o3 znika z ChatGPT 26 sierpnia, po dziewięćdziesięciodniowym okresie przejściowym, a razem z nim GPT-4.5. Z produktu wypada tym samym ostatni model z rodziny GPT-4 — po wycofaniu GPT-4o i wariantów GPT-4.1 w lutym 2026. Zmiana nie dotyczy API, gdzie o3 odpowiada do grudnia, więc przez kilka miesięcy ten sam model będzie żywy dla programistów i nieobecny dla wszystkich pozostałych. Dla katalogu takiego jak ten ważniejszy od pojedynczych dat jest sam wzorzec: model czołowy stał się produktem o żywotności liczonej w miesiącach, a profil modelu coraz częściej musi odnotowywać nie tylko to, kiedy powstał, lecz i to, kiedy przestaje odpowiadać.

GPT-5