GPT-Realtime-1.5
OpenAI · USA · 2026
Model roboczy dla asystentów głosowych — ogniwo między pierwszym Realtime a rozumującą generacją, która go zastąpiła.
GPT-Realtime-1.5, wydany 23 lutego 2026 roku razem z GPT-Audio-1.5, był modelem mowa-w-mowę z połowy generacji, przedstawianym przez producenta jako najlepszy model firmy do dźwięku na wejściu i wyjściu, wprost adresowany do asystentów głosowych i infolinii obsługi klienta. Przyjmuje tekst, dźwięk i obrazy, odpowiada tekstem lub mową przez punkt końcowy Realtime, wywołuje funkcje i buforuje prompt. Od późniejszych modeli 2.x różni go kontekst: mieści zaledwie 32 tysiące tokenów i oddaje najwyżej 4096, co wystarcza na rozmowę z infolinią, ale nie na asystenta, który musi utrzymać długą sesję i stos wyników narzędzi. Dźwięk kosztuje 32 dolary za milion tokenów wejścia i 64 za milion wyjścia, tekst 4 i 16 dolarów, obraz 5 dolarów na wejściu. Wiedza modelu kończy się 30 września 2024 roku, a działa on wyłącznie na /v1/realtime — bez chat completions, trybu wsadowego i asystentów.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!