MDL-3396EST.2026 · IDX.281
AudioW produkcji

GPT-Realtime-1.5

OpenAI · USA · 2026

Model roboczy dla asystentów głosowych — ogniwo między pierwszym Realtime a rozumującą generacją, która go zastąpiła.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GPT-Realtime-1.5, wydany 23 lutego 2026 roku razem z GPT-Audio-1.5, był modelem mowa-w-mowę z połowy generacji, przedstawianym przez producenta jako najlepszy model firmy do dźwięku na wejściu i wyjściu, wprost adresowany do asystentów głosowych i infolinii obsługi klienta. Przyjmuje tekst, dźwięk i obrazy, odpowiada tekstem lub mową przez punkt końcowy Realtime, wywołuje funkcje i buforuje prompt. Od późniejszych modeli 2.x różni go kontekst: mieści zaledwie 32 tysiące tokenów i oddaje najwyżej 4096, co wystarcza na rozmowę z infolinią, ale nie na asystenta, który musi utrzymać długą sesję i stos wyników narzędzi. Dźwięk kosztuje 32 dolary za milion tokenów wejścia i 64 za milion wyjścia, tekst 4 i 16 dolarów, obraz 5 dolarów na wejściu. Wiedza modelu kończy się 30 września 2024 roku, a działa on wyłącznie na /v1/realtime — bez chat completions, trybu wsadowego i asystentów.

#speech to speech#voice agents#realtime#customer support#api only
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję