Newsy

Co słychać w robotyce i AI — wybór redakcji wujec.ai.

Premiery22.08.2026 · xAI developer documentation (pricing, release notes, Batch API)

Nowy model wideo xAI kosztuje o 60% więcej za sekundę — i jako jedyny nie wchodzi do własnego trybu wsadowego

Dokumentacja deweloperska xAI wymienia dziś dwie generacje modelu wideo obok siebie, a różnica między nimi nie jest wyłącznie techniczna. Grok Imagine Video 1.5, którego pełen zestaw trybów ogłoszono 31 lipca 2026 roku, kosztuje 0,080 USD za sekundę wygenerowanego materiału. Model pierwszej generacji, grok-imagine-video, wciąż stoi w cenniku po 0,050 USD za sekundę — nowszy jest więc droższy o 60 procent. Za wyższą stawkę użytkownik dostaje natywne 1080p w trybach tekst-do-wideo i zdjęcie-do-wideo, zamiast renderu w niższej rozdzielczości powiększanego po fakcie, a do tego tryb referencyjny, w którym kilka obrazów podpowiada wygląd postaci lub przedmiotu, nie ustalając pierwszej klatki, oraz możliwość dołączenia do trzech gotowych głosów. Klipy trwają od jednej do piętnastu sekund; osobne punkty API przedłużają gotowe nagranie od ostatniej klatki albo je edytują, przy czym edycja jest ograniczona do 720p i około 8,7 sekundy. Mniej reklamowana część stoi w dokumentacji trybu wsadowego. Batch API xAI, które przetwarza duże wolumeny zapytań asynchronicznie i taniej, przyjmuje zlecenia obrazowe i wideo wyłącznie dla modeli pierwszej generacji: grok-imagine-image i grok-imagine-video. Oba modele generacji 1.5 — wideo oraz Grok Imagine Image 2.0 — są odsyłane komunikatem o braku obsługi przetwarzania wsadowego. Dla kogoś, kto generuje materiał hurtowo, nowszy model jest zatem droższy podwójnie: wyższa stawka za sekundę i brak dostępu do tańszej kolejki. Dokumentacja zdradza też, jak naprawdę działa w tym modelu generowanie z opisu. To nie jest jeden przebieg: producent pisze, że model najpierw tworzy z opisu pierwszą klatkę, a dopiero potem wprawia ją w ruch. Obraz pośredni nie wraca do użytkownika, choć całość jest jednym płatnym zapytaniem.

Grok Imagine Video 1.5
Premiery11.08.2026 · BytePlus ModelArk documentation

Nowy model wideo ByteDance utrzymuje jedno ujecie przez trzydziesci sekund - a jego karta API po cichu mowi 720p, nie 4K

Seedance 2.5 od ByteDance Seed to pierwszy model wideo tej firmy zbudowany pod sceny, a nie pod klipy. Gorny limit jednej generacji wzrosl z pietnastu sekund do trzydziestu, a dokumentacja mowi wyraznie, ze te trzydziesci sekund to jedno spojne ujecie - nie zszyte odcinki, czym wiekszosc narzedzi osiaga podobna dlugosc. Dzwiek powstaje w tym samym przebiegu co obraz, a nagranie odniesienia - mowa, muzyka albo efekty - moze byc jedynym wejsciem, do ktorego dopasowane zostaje tempo i ruch ust. Zdolnosc, ktora producent stawia na pierwszym miejscu, nazywa sie omni reference. Jedno zapytanie moze zawierac do pieciudziesieciu materialow - trzydziesci obrazow, dziesiec klipow wideo i dziesiec plikow dzwiekowych - a model czyta je razem. W praktyce zmienia to jeden punkt dostepowy w cztery narzedzia: tekst-na-wideo, generowanie z pierwszej klatki albo z pary pierwsza-ostatnia, edycje istniejacego nagrania po znaczniku czasu (podmiana bohatera, usuniecie obiektu, przemalowanie czesci kadru z zachowaniem oryginalnych proporcji i dlugosci) oraz przedluzanie klipu w przod lub w tyl. Wyjscie rozszerzono o format mov z obrazem H.264 i dzwiekiem PCM, zeby kolor i dzwiek przetrwaly montaz. Jedna z krazacych liczb nie wytrzymuje sprawdzenia. Wiele relacji przypisuje Seedance 2.5 wyjscie w 4K; karta modelu w BytePlus ModelArk podaje dla dreamina-seedance-2-5-260628 rozdzielczosci 480p i 720p, a do 1080p i 4K opisany jest starszy wpis Seedance 2.0. Tabela cen jest rownie konkretna - 10,70 USD za milion tokenow bez wideo na wejsciu i 6,40 USD z wideo - i dotyczy wylacznie wyjsc 480p oraz 720p. Jak w calej linii wideo ByteDance, nie opublikowano ani wag, ani liczby parametrow, ani raportu technicznego.

Seedance 2.5
Premiery5.08.2026 · OpenAI — Deprecations (developers.openai.com)

Siedem tygodni dla Sory 2: API wideo OpenAI gaśnie 24 września, bez wskazanego następcy

Tabela wycofań OpenAI wyznacza twardą datę dla najgłośniejszego modelu wideo 2025 roku: sora-2, sora-2-pro i wszystkie datowane migawki (sora-2-2025-10-06, sora-2-2025-12-08, sora-2-pro-2025-10-06) przestają działać 24 września 2026 r. Razem z nimi wygaszany jest punkt końcowy Videos API, który je obsługiwał. Wycofanie ogłoszono 24 marca 2026 r., zostaje więc około siedmiu tygodni dla wszystkiego, co wciąż generuje wideo przez OpenAI. Szczegół, który zasługuje na uwagę, to pusta rubryka. Wpisy o wycofaniu u OpenAI zwykle kierują programistów do modelu zastępczego; przy Sorze nie ma żadnego, a następca nie został ogłoszony. To rzadki przypadek, w którym duże laboratorium wychodzi z całej kategorii produktu, zamiast podnosić w niej wersję — a mowa o modelu, który nie ma jeszcze roku, przyszedł z zsynchronizowanym dialogiem i dźwiękiem, wiarygodną fizyką obiektów oraz funkcją cameo realnych osób z kontrolą zgody, i wyszedł z aplikacją, która pokazała wideo z AI masowej publiczności. Sora 2 zachowuje profil w naszym katalogu. Nie kasujemy profili wycofanych modeli — wpis został przepisany tak, by podawał datę wyłączenia, warianty API i obowiązujące ceny, a także zaznaczał, że doniesienia branżowe o zamknięciu aplikacji konsumenckiej w kwietniu 2026 r. wykraczają poza to, co potwierdza dokumentacja samego OpenAI.

Sora 2