GPT-Audio-1.5
OpenAI · USA · 2026
Rozmowa głosem bez instalacji strumieniowej — model odpowiada dźwiękiem przez zwykłe zapytanie REST.
GPT-Audio-1.5, wydany 23 lutego 2026 roku, to model dźwiękowy OpenAI dla interfejsu Chat Completions: przyjmuje mowę lub tekst i oddaje mowę lub tekst, bez stałej sesji WebRTC czy WebSocket, jakiej wymagają modele Realtime. Ta jedna decyzja projektowa jest sensem całego modelu. Programista, który już wysyła JSON do zwykłego punktu końcowego czatu, dokłada odpowiedź głosem, zmieniając treść zapytania, a nie warstwę transportu — to najtańsze wejście w głos dla istniejących aplikacji, okupione brakiem niskiego opóźnienia i obsługi wejścia w słowo, które daje wyłącznie sesja na żywo. Model mieści 128 tysięcy tokenów kontekstu, oddaje do 16 384 tokenów, strumieniuje odpowiedź i wywołuje funkcje. Dźwięk kosztuje 32 dolary za milion tokenów wejścia i 64 za milion wyjścia, tekst pozostaje przy zwykłych 2,50 i 10 dolarach. Wiedza modelu kończy się 30 września 2024 roku.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!