MDL-9947EST.2026 · IDX.343
AudioW produkcji

GPT-Realtime-2.1 mini

OpenAI · USA · 2026

Ta sama rozmowa na żywo za mniej więcej jedną trzecią ceny — destylowana wersja rozumującego modelu głosowego.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GPT-Realtime-2.1 mini, wydany 6 lipca 2026 roku razem z pełnym modelem, to destylowana wersja rozumującego modelu głosowego OpenAI, a powodem, dla którego warto się nim zainteresować, jest rachunek. Dźwięk kosztuje 10 dolarów za milion tokenów wejścia i 20 za milion wyjścia wobec 32 i 64 w pełnym modelu — minuta rozmowy na żywo, w której model myśli przed odpowiedzią, tanieje mniej więcej trzykrotnie. Tekst spada jeszcze mocniej, do 60 centów na wejściu i 2,40 dolara na wyjściu. Wszystko, co strukturalne, zostaje: 128 tysięcy tokenów kontekstu, do 32 tysięcy tokenów wyjścia, tokeny rozumowania, wywoływanie funkcji, na wejściu tekst, dźwięk i obraz, na wyjściu tekst i mowa, przez WebRTC, WebSocket albo SIP. Oddana zostaje głębia, zwyczajem modeli destylowanych — to tania półka dla dużego ruchu głosowego, a nie model, po który sięga się wtedy, gdy odpowiedź musi być trafna za pierwszym razem. Wiedza kończy się 30 września 2024 roku, a model działa wyłącznie na punkcie końcowym Realtime.

#speech to speech#voice agents#realtime#reasoning#api only
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję