GPT-Realtime mini to tania odmiana głosowego API OpenAI: te same połączenia WebRTC, WebSocket i SIP co w pełnym modelu, ten sam kontekst 32 tysięcy tokenów i limit 4096 tokenów odpowiedzi, ale mniej więcej szósta część ceny tekstu — 0,60 i 2,40 dolara za milion tokenów. Model pojawił się z migawką datowaną na 6 października 2025 roku, a od 7 maja 2026 był tym, na który OpenAI kazało przechodzić użytkownikom wyłączanego gpt-4o-mini-realtime-preview. Ta rekomendacja utrzymała się osiem miesięcy: 20 lipca 2026 roku sam trafił na listę wycofań, z usunięciem z API 20 stycznia 2027 roku i następcą gpt-realtime-2.1-mini. Ograniczanie zaczęło się wcześniej — pierwotną migawkę z października 2025 wyłączono już 23 lipca 2026, zostawiając w ruchu wyłącznie gpt-realtime-mini-2025-12-15. Zakres funkcji jest celowo ubogi wobec pełnego modelu: wywoływanie funkcji i buforowanie promptu, bez serwerów MCP. Stawek za tokeny dźwiękowe producent dla niego już nie publikuje; w bieżącym cenniku jest tylko następca, po 10 i 20 dolarów za milion tokenów dźwięku.
#speech to speech#voice agents#realtime#api only#retiring