GPT-Realtime-2.1 mini
OpenAI · USA · 2026
Ta sama rozmowa na żywo za mniej więcej jedną trzecią ceny — destylowana wersja rozumującego modelu głosowego.
GPT-Realtime-2.1 mini, wydany 6 lipca 2026 roku razem z pełnym modelem, to destylowana wersja rozumującego modelu głosowego OpenAI, a powodem, dla którego warto się nim zainteresować, jest rachunek. Dźwięk kosztuje 10 dolarów za milion tokenów wejścia i 20 za milion wyjścia wobec 32 i 64 w pełnym modelu — minuta rozmowy na żywo, w której model myśli przed odpowiedzią, tanieje mniej więcej trzykrotnie. Tekst spada jeszcze mocniej, do 60 centów na wejściu i 2,40 dolara na wyjściu. Wszystko, co strukturalne, zostaje: 128 tysięcy tokenów kontekstu, do 32 tysięcy tokenów wyjścia, tokeny rozumowania, wywoływanie funkcji, na wejściu tekst, dźwięk i obraz, na wyjściu tekst i mowa, przez WebRTC, WebSocket albo SIP. Oddana zostaje głębia, zwyczajem modeli destylowanych — to tania półka dla dużego ruchu głosowego, a nie model, po który sięga się wtedy, gdy odpowiedź musi być trafna za pierwszym razem. Wiedza kończy się 30 września 2024 roku, a model działa wyłącznie na punkcie końcowym Realtime.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!