Newsy
Co słychać w robotyce i AI — wybór redakcji wujec.ai.
Najlepszym modelem do kodowania OpenAI nazywa maszynę z lutego — a ta nie wie nic, co powstało po sierpniu 2025
Dokumentacja OpenAI opisuje GPT-5.3-Codex jako „najlepszy jak dotąd model do agentowego kodowania". Model trafił do sprzedaży 24 lutego 2026 r. Pół roku później to zdanie wciąż obowiązuje, bo nic go nie zastąpiło: wyspecjalizowana linia Codex nie dostała od tego czasu żadnej nowej pozycji. Ogólna linia w tym samym czasie nie stała w miejscu. GPT-5.5 pojawił się 24 kwietnia, a trzyczęściowa rodzina GPT-5.6 — Sol, Terra i Luna — 9 lipca, przy czym firmowy opis GPT-5.6 Sol brzmi dziś „zacznij tu, gdy chodzi o złożone rozumowanie i kodowanie". Specjalista i model ogólny są więc kierowani do tej samej pracy. Różnica między nimi nie jest marketingowa. GPT-5.6 Sol ma okno kontekstu 1 050 000 tokenów wobec 400 000 u modelu Codex i granicę wiedzy z 16 lutego 2026 r. wobec 31 sierpnia 2025 r. W modelu do kodowania ta druga liczba waży więcej, niż się wydaje: granica z sierpnia 2025 r. oznacza, że narzędzie piszące wywołanie biblioteki nie widziało roku jej wydań, wycofanych funkcji i zmian łamiących zgodność. Starszy model broni się ceną. GPT-5.3-Codex kosztuje 1,75 dolara za milion tokenów wejściowych i 14 dolarów za milion wyjściowych wobec 4 i 20 dolarów u GPT-5.6 Sol — czyli nieco ponad połowę stawki wejściowej. Jest też z założenia węższy: linia Codex działa wyłącznie przez interfejs Responses, bez Chat Completions, bez trybu wsadowego i bez dostrajania. Zostaje wybór, którego OpenAI nigdzie nie przedstawia w jednym miejscu. Tani specjalista stoi w czasie, drogi model ogólny jest aktualny. W dokumentacji nie ma informacji, że linia Codex została zamknięta, nie ogłoszono też dla niej daty wyłączenia — i właśnie dlatego półroczna cisza zasługuje na odnotowanie, a nie na domysły. Liczby w tym artykule pochodzą z firmowych kart modeli i tabel cennika OpenAI, odczytanych 26 sierpnia 2026 r.; daty premier sprawdziliśmy dodatkowo w niezależnym rejestrze modeli, bo OpenAI swoich kart nie datuje.
OpenAI wypuszcza model wytrenowany, by przestał odmawiać: GPT-5.6 Cyber odpowiada na 95% pytań o włamania — i prawie nikt go nie kupi
OpenAI ogłosiła GPT-5.6 Cyber 10 sierpnia 2026 roku, a liczba postawiona na pierwszym miejscu jest nietypowa: to nie wynik sprawności, lecz odsetek udzielonych odpowiedzi. We własnej mierze firmy — Advanced Cybersecurity Completion Rate, czyli jak często model odpowiada na pytania o łańcuchy exploitów, obejście uwierzytelniania i eskalację uprawnień, zamiast odmówić — nowy model odpowiada na 95,0% z nich. GPT-5.6 Sol za standardowymi zabezpieczeniami odpowiada na 1,5%. Zeszłoroczny GPT-5.5 Cyber osiągał 57,3%. Model zbudowano na GPT-5.6 Sol i dotrenowano do wyszukiwania podatności zero-day oraz budowy exploitów. Jego przydatność pokazano już na działającym oprogramowaniu: OpenAI zbadała nim V8, silnik JavaScriptu w Chrome, i znalazła dwa nieznane wcześniej błędy, które razem pozwalają wyjść z piaskownicy sterty. Google naprawił je jako CVE-2026-15903. Firma raportuje też co najmniej pięć podatności w powszechnie używanym systemie mobilnym, trzy krytyczne błędy w popularnej bazie danych i ponad 400 możliwości eskalacji uprawnień w jądrze systemu — wszystko w trybie skoordynowanego ujawniania. O wadze premiery nie decyduje jednak sama sprawność, bo miejscami jest ona niższa. W trudniejszym ExploitBench 3, gdzie zabezpieczenia piaskownicy V8 pozostają włączone, zwykły GPT-5.6 Sol rozwiązuje więcej w standardowym limicie 300 tur; różnica zaciera się dopiero przy 600. W wewnętrznej ocenie raportów o podatnościach Cyber wypada gorzej od Sola, co firma tłumaczy krótszymi i uboższymi opisami. W ramach Preparedness Framework model dostał ocenę High dla zdolności cybernetycznych — taką samą jak Sol — i poniżej progu Critical. Zmieniło się to, kto może pytać. GPT-5.6 Cyber istnieje wyłącznie w Daybreak Red, ofensywnym poziomie programu dostępu, który OpenAI rozszerzyła tego samego dnia; defensywny Daybreak Blue zostawia modele ogólnego przeznaczenia z zabezpieczeniami nastawionymi na obronę. Wejście wymaga weryfikacji tożsamości, ograniczeń dozwolonych zastosowań, monitoringu i oświadczeń prawnych, a od 1 września 2026 każde konto indywidualne w Daybreak musi używać sprzętowego klucza bezpieczeństwa. Wśród wymienionych wcześniejszych partnerów są Accenture, IBM, Capgemini, EY, KPMG, PwC, Palo Alto Networks, CrowdStrike, Cloudflare, Akamai, Fortinet, Sophos i SpecterOps. Technicznie model jest węższy od Sola: okno kontekstu 400 000 tokenów wobec 1 050 000, wyjście do 128 000 tokenów, na wejściu tekst i obraz, na wyjściu tekst, wiedza do 16 lutego 2026. Działa tylko na endpoincie Responses — bez chat completions, trybu wsadowego i dostrajania — a cennik to 12,50 USD za milion tokenów wejścia i 75 USD za milion wyjścia, dwa i pół raza więcej niż u Sola. Pełną kartę systemową firma zapowiedziała na później.
GPT-5.6 Cyber →