GPT-5.6 Cyber
OpenAI · USA · 2026
Pierwszy model OpenAI dostrojony tak, by nie odmawiał ofensywnej pracy nad bezpieczeństwem — i pierwszy, którego firma nie sprzedaje wszystkim.
GPT-5.6 Cyber to wyspecjalizowany wariant GPT-5.6 Sol, ogłoszony 10 sierpnia 2026 roku i wytrenowany do jednego zadania: autoryzowanych badań podatności, weryfikacji exploitów i testów bezpieczeństwa. To pierwszy model OpenAI, którego główną poprawą jest niższy odsetek odmów, a nie wyższy wynik w benchmarku. Liczba, którą OpenAI stawia na pierwszym miejscu, pochodzi z jej własnej miary Advanced Cybersecurity Completion Rate — jak często model faktycznie odpowiada na pytania o budowę łańcuchów exploitów, obejście uwierzytelniania czy eskalację uprawnień, zamiast odmówić. GPT-5.6 Cyber odpowiada na 95,0% z nich. Te same pytania zadane GPT-5.6 Sol za standardowymi zabezpieczeniami dają 1,5%, a w defensywnym poziomie Daybreak Blue — 2,0%. Poprzednia generacja, GPT-5.5 Cyber, osiągała 57,3%. Sama sprawność zmieniła się mniej niż gotowość do odpowiadania, a OpenAI publikuje również porażki. W ExploitGym 2 — zamianie znanych podatności w działające exploity — Cyber wygrywa i z Solem, i z GPT-5.5 Cyber. W trudniejszym ExploitBench 3, gdzie atakuje się silnik V8 z włączonymi zabezpieczeniami piaskownicy, zwykły GPT-5.6 Sol rozwiązuje zadania oszczędniej w standardowym limicie 300 tur; różnica zaciera się dopiero przy 600 turach. W wewnętrznej ocenie raportów o podatnościach Cyber wypada gorzej od Sola, co OpenAI tłumaczy tym, że pisze krótsze i mniej szczegółowe raporty. W ramach Preparedness Framework dostał ocenę High dla zdolności cybernetycznych — tak samo jak Sol — i poniżej progu Critical. Mocniejszym argumentem są wyniki w praktyce. OpenAI użyła modelu do zbadania V8, silnika JavaScriptu w Chrome, i znalazła dwa nieznane wcześniej błędy, które razem pozwalają wyjść z piaskownicy sterty; Google naprawił je jako CVE-2026-15903. Firma raportuje też co najmniej pięć podatności w popularnym systemie mobilnym, trzy krytyczne błędy w powszechnie używanej bazie danych i ponad 400 możliwości eskalacji uprawnień w jądrze popularnego systemu — wszystko w trybie skoordynowanego ujawniania. Dostęp jest tu cechą definiującą. Model istnieje wyłącznie w Daybreak Red, ofensywnym poziomie programu partnerskiego OpenAI, za weryfikacją tożsamości, ograniczeniami dozwolonych zastosowań, monitoringiem i oświadczeniami prawnymi; od 1 września 2026 każde indywidualne konto w Daybreak musi używać sprzętowego klucza bezpieczeństwa. Wśród wymienionych wcześniejszych partnerów są Accenture, IBM, Capgemini, EY, KPMG, PwC, Palo Alto Networks, CrowdStrike, Cloudflare, Akamai, Fortinet, Sophos i SpecterOps. Technicznie jest to młodszy brat Sola: okno 400 000 tokenów wobec 1 050 000 u Sola, 272 000 tokenów wejścia, 128 000 wyjścia, na wejściu tekst i obraz, na wyjściu tekst, wiedza do 16 lutego 2026. Działa tylko na endpoincie Responses — bez chat completions, bez trybu wsadowego, bez dostrajania — i kosztuje 12,50 USD za milion tokenów wejścia oraz 75 USD za milion wyjścia, dwa i pół raza drożej niż Sol. Kartę systemową z pełniejszymi ocenami OpenAI zapowiedziała na później.
▸Newsy
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!