MDL-9069EST.2026 · IDX.779
AudioW produkcji

GPT-Audio-1.5

OpenAI · USA · 2026

Rozmowa głosem bez instalacji strumieniowej — model odpowiada dźwiękiem przez zwykłe zapytanie REST.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GPT-Audio-1.5, wydany 23 lutego 2026 roku, to model dźwiękowy OpenAI dla interfejsu Chat Completions: przyjmuje mowę lub tekst i oddaje mowę lub tekst, bez stałej sesji WebRTC czy WebSocket, jakiej wymagają modele Realtime. Ta jedna decyzja projektowa jest sensem całego modelu. Programista, który już wysyła JSON do zwykłego punktu końcowego czatu, dokłada odpowiedź głosem, zmieniając treść zapytania, a nie warstwę transportu — to najtańsze wejście w głos dla istniejących aplikacji, okupione brakiem niskiego opóźnienia i obsługi wejścia w słowo, które daje wyłącznie sesja na żywo. Model mieści 128 tysięcy tokenów kontekstu, oddaje do 16 384 tokenów, strumieniuje odpowiedź i wywołuje funkcje. Dźwięk kosztuje 32 dolary za milion tokenów wejścia i 64 za milion wyjścia, tekst pozostaje przy zwykłych 2,50 i 10 dolarach. Wiedza modelu kończy się 30 września 2024 roku.

#audio#speech to speech#chat completions#voice#api only
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję