Newsy
Co słychać w robotyce i AI — wybór redakcji wujec.ai.
Drabinka cen flagowca OpenAI podwaja się na każdym szczeblu — a jedyny poziom z podaną prędkością to ten, którego nie da się kupić
Pięć dni po tym, jak OpenAI podało pierwszą w historii swojego API liczbę tokenów na sekundę — 750 tokenów wyjścia dla zapowiedzianego trybu Ultrafast w GPT-5.6 Sol — ten poziom wciąż nie ma ceny. Poziom, który cenę ma, wciąż nie ma prędkości. Te dwa fakty należą do siebie, a układ cennika OpenAI pokazuje rzecz ostrzej niż którykolwiek z komunikatów. OpenAI sprzedaje GPT-5.6 Sol na trzech płatnych poziomach obsługi i na własnej stronie cennika każdy z nich jest dokładnie dwukrotnością poprzedniego. Przetwarzanie Flex i wsadowe kosztuje 2,50 USD za milion tokenów wejścia i 15 USD za milion wyjścia. Standard kosztuje 5 i 30 USD. Tryb Fast kosztuje 10 i 60 USD. Podwojenie obowiązuje też w wierszach długiego kontekstu, które dotyczą zapytań powyżej progu 272 000 tokenów: 5 i 22,50 dla Flexa, 10 i 45 dla Standardu, 20 i 90 dla Fasta. Osiem liczb, cztery dokładne dwójki, bez zaokrągleń i bez wyjątków. Czego ta drabinka nie niesie, to choćby jedna prędkość. Tryb Fast ma 100% dopłaty ponad Standard, a OpenAI nigdy nie podało ani liczby tokenów na sekundę, ani wartości opóźnienia, ani procentu, które mówiłyby, co ta dopłata daje. Flex opisany jest wyłącznie jako „wolniejsze czasy odpowiedzi i okresowa niedostępność zasobów” — również bez żadnej liczby. Klient wybierający między szczeblami wybiera więc między cenami podanymi co do centa a prędkościami, których nie podano wcale. Ultrafast odwraca ten układ dokładnie. To pierwszy poziom obsługi, do którego OpenAI dołożyło liczbę przepustowości — „do 750 tokenów wyjścia na sekundę”, „do 14× szybciej niż przetwarzanie Standard” — i jedyny, który nie ma ceny; dostępny jest w ograniczonej zapowiedzi dla wybranej grupy klientów. Z tych dwóch liczb da się wyprowadzić punkt odniesienia, z zastrzeżeniem, które ma znaczenie. Jeżeli 750 tokenów na sekundę i mnożnik 14× opisują ten sam przebieg, przetwarzanie Standard generuje mniej więcej 54 tokeny wyjścia na sekundę. Byłaby to najbliższa opublikowanemu punktowi odniesienia wartość, jaką ten model ma. Ale obie liczby to pułapy opatrzone słowem „do”, a OpenAI nie twierdzi, że mierzono je w tym samym przebiegu — 54 jest więc wnioskiem z komunikatu, a nie liczbą ujawnioną przez firmę. Czego to NIE dowodzi: nic tutaj nie wskazuje, ile Ultrafast będzie kosztował, gdy dostanie cenę. Podwajanie na trzech istniejących szczeblach opisuje obecną listę, a nie zobowiązanie co do następnego, a cena z okresu zapowiedzi nie musi przetrwać do powszechnej dostępności.
GPT-5.6 Sol →Najmocniejszy model OpenAI odpowiada teraz czternaście razy szybciej — na układach, których OpenAI nie zbudowało
OpenAI ogłosiło 13 sierpnia 2026 wczesny podgląd Ultrafast — nowej warstwy usługowej API, która uruchamia model GPT-5.6 Sol z prędkością do 750 tokenów wyjścia na sekundę, czyli nawet czternaście razy szybciej niż przetwarzanie standardowe. Firma nie podała ani ceny, ani terminu powszechnej dostępności. Dostęp ma wybrana grupa klientów, dla pozostałych jest formularz zgłoszeniowy. Inżynieria nie jest jednak dziełem OpenAI. Ultrafast działa na procesorach Cerebras wykonanych w skali całego plastra krzemu, które mieszczą 44 GB pamięci SRAM bezpośrednio w układzie i dzięki temu omijają barierę przepustowości pamięci ograniczającą generowanie tokenów w zwykłych klastrach GPU. To fakt wart zatrzymania: najmocniejszy model, jaki OpenAI sprzedaje, osiąga swoją najwyższą prędkość na krzemie zaprojektowanym przez inną firmę, a w tym zdaniu nie ma ani NVIDII, ani własnego programu sprzętowego OpenAI. OpenAI przedstawia tę zmianę jako przesunięcie w tym, z czego trzeba zrezygnować. Do tej pory odpowiedź w czasie rzeczywistym oznaczała sięgnięcie po model mniejszy albo bardziej wyspecjalizowany; firma nazywa alternatywę „większą ilością użytecznej pracy na sekundę”. Wymienione zastosowania to takie, w których zegar jest częścią problemu — czytanie dzienników i świeżych zmian w kodzie, gdy awaria wciąż trwa, ocena transakcji, gdy warunki rynkowe jeszcze się zmieniają, odpowiedź kupującemu, zanim wahanie zamieni się w porzucony koszyk. Wewnętrznie OpenAI podaje, że partie eksperymentów badawczych, które dotąd liczyły się przez noc, mieszczą się dziś w dniu pracy jako kilka kolejnych podejść. Jedno szeroko powtarzane porównanie trzeba czytać ostrożnie. Liczby mówiące, że GPT-5.6 Sol na Ultrafast przeszedł wszystkie 2500 pytań testu Humanity's Last Exam w 11 godzin i 11 minut wobec 78 godzin i 27 minut dla Claude Fable 5, pochodzą od Cerebras — czyli od dostawcy sprzętu, a nie od niezależnego oceniającego — i mierzą czas przebiegu testu, a nie trafność odpowiedzi. Własna deklaracja OpenAI jest węższa i bardziej użyteczna: w teście GDP-Val, mierzącym ekonomicznie wartościową pracę umysłową, firma podaje 5,6-krotne przyspieszenie całego procesu wobec przetwarzania standardowego, bez utraty jakości. Ultrafast to warstwa usługowa, a nie nowy model. Wagi są te same, co w opisanym już w katalogu GPT-5.6 Sol; zmieniło się to, gdzie się je liczy i jak szybko wychodzą tokeny.
GPT-5.6 Sol →