Wszystkie newsyPremiery

Najmocniejszy model OpenAI odpowiada teraz czternaście razy szybciej — na układach, których OpenAI nie zbudowało

Opublikowano: 15.08.2026 · Źródło: OpenAI, Previewing Ultrafast mode

OpenAI ogłosiło 13 sierpnia 2026 wczesny podgląd Ultrafast — nowej warstwy usługowej API, która uruchamia model GPT-5.6 Sol z prędkością do 750 tokenów wyjścia na sekundę, czyli nawet czternaście razy szybciej niż przetwarzanie standardowe. Firma nie podała ani ceny, ani terminu powszechnej dostępności. Dostęp ma wybrana grupa klientów, dla pozostałych jest formularz zgłoszeniowy. Inżynieria nie jest jednak dziełem OpenAI. Ultrafast działa na procesorach Cerebras wykonanych w skali całego plastra krzemu, które mieszczą 44 GB pamięci SRAM bezpośrednio w układzie i dzięki temu omijają barierę przepustowości pamięci ograniczającą generowanie tokenów w zwykłych klastrach GPU. To fakt wart zatrzymania: najmocniejszy model, jaki OpenAI sprzedaje, osiąga swoją najwyższą prędkość na krzemie zaprojektowanym przez inną firmę, a w tym zdaniu nie ma ani NVIDII, ani własnego programu sprzętowego OpenAI. OpenAI przedstawia tę zmianę jako przesunięcie w tym, z czego trzeba zrezygnować. Do tej pory odpowiedź w czasie rzeczywistym oznaczała sięgnięcie po model mniejszy albo bardziej wyspecjalizowany; firma nazywa alternatywę „większą ilością użytecznej pracy na sekundę”. Wymienione zastosowania to takie, w których zegar jest częścią problemu — czytanie dzienników i świeżych zmian w kodzie, gdy awaria wciąż trwa, ocena transakcji, gdy warunki rynkowe jeszcze się zmieniają, odpowiedź kupującemu, zanim wahanie zamieni się w porzucony koszyk. Wewnętrznie OpenAI podaje, że partie eksperymentów badawczych, które dotąd liczyły się przez noc, mieszczą się dziś w dniu pracy jako kilka kolejnych podejść. Jedno szeroko powtarzane porównanie trzeba czytać ostrożnie. Liczby mówiące, że GPT-5.6 Sol na Ultrafast przeszedł wszystkie 2500 pytań testu Humanity's Last Exam w 11 godzin i 11 minut wobec 78 godzin i 27 minut dla Claude Fable 5, pochodzą od Cerebras — czyli od dostawcy sprzętu, a nie od niezależnego oceniającego — i mierzą czas przebiegu testu, a nie trafność odpowiedzi. Własna deklaracja OpenAI jest węższa i bardziej użyteczna: w teście GDP-Val, mierzącym ekonomicznie wartościową pracę umysłową, firma podaje 5,6-krotne przyspieszenie całego procesu wobec przetwarzania standardowego, bez utraty jakości. Ultrafast to warstwa usługowa, a nie nowy model. Wagi są te same, co w opisanym już w katalogu GPT-5.6 Sol; zmieniło się to, gdzie się je liczy i jak szybko wychodzą tokeny.