GPT-4o
OpenAI · United States · 2024
Model, który nauczył chatboty rozmawiać w czasie rzeczywistym — i ten, o którego zachowanie upominali się użytkownicy.
GPT-4o, wydany 13 maja 2024 roku, był pierwszym naprawdę multimodalnym modelem OpenAI od wejścia po wyjście. Wcześniejsza rozmowa głosowa w ChatGPT składała się z trzech osobnych systemów — rozpoznawania mowy, modelu tekstowego i syntezy mowy — co gubiło ton głosu, dźwięki tła i możliwość wejścia w słowo. GPT-4o przetwarzał tekst, dźwięk i obraz w jednej sieci, odpowiadając na nagranie już po 232 milisekundach, średnio w około 320 ms, czyli w tempie zbliżonym do ludzkiej rozmowy. Litera „o" pochodzi od słowa omni. Poza zmianą sposobu interakcji model dorównywał GPT-4 Turbo w angielskim tekście i kodzie, będąc przy tym mniej więcej dwa razy szybszym i o połowę tańszym, a wyraźnie zyskał w językach innych niż angielski oraz w rozumieniu obrazu i dźwięku. Okno kontekstu wynosiło 128 000 tokenów, granica wiedzy przypadała na październik 2023, a OpenAI — podobnie jak przy GPT-4 — nie ujawniło ani liczby parametrów, ani architektury. GPT-4o stał się też modelem, do którego ludzie się przywiązali. Gdy w sierpniu 2025 OpenAI ustawiło GPT-5 jako domyślny w ChatGPT i usunęło starszy model, sprzeciw był na tyle silny, że GPT-4o przywrócono płacącym użytkownikom w ciągu kilku dni. Był to pierwszy przypadek, w którym nastroje użytkowników w widoczny sposób cofnęły wycofanie modelu. Prawdziwe wycofanie przyszło etapami: usunięcie z ChatGPT 13 lutego 2026, pozostawienie w Custom GPTs dla klientów biznesowych, korporacyjnych i edukacyjnych do 3 kwietnia 2026 oraz wyłączenie końcówki API chatgpt-4o-latest 16 lutego 2026. Mniejsze rodzeństwo, GPT-4o mini, pojawiło się w lipcu 2024 i przez długi czas było najtańszym sensownym modelem na rynku, co uczyniło je domyślnym wyborem do pracy produkcyjnej na dużą skalę, a nie do pokazów.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!