GPT-Audio mini to tani model OpenAI do dźwięku, który nie musi docierać na żywo: przyjmuje mowę i tekst w jednym wywołaniu Chat Completions i odpowiada mową albo tekstem, co pasuje do wiadomości głosowych, nagrań i lektora, a nie do rozmowy. Jego liczby powtarzają wzór widoczny w całej rodzinie — model turowy dostaje 128 tysięcy tokenów kontekstu i 16 384 tokeny odpowiedzi, czyli okno cztery razy większe niż GPT-Realtime mini, bo nie musi utrzymywać otwartego połączenia. Tekst kosztuje w obu tyle samo: 0,60 i 2,40 dolara za milion tokenów. Model pojawił się jako migawka datowana na 6 października 2025 roku, a 7 maja 2026 stał się drogą zalecaną, gdy usunięto gpt-4o-mini-audio-preview. 20 lipca 2026 roku OpenAI objęło uprzedzeniem całą starszą rodzinę dźwiękową: gpt-audio-mini znika z API 20 stycznia 2027 roku, a następcą jest gpt-audio-1.5 — ten sam, którego wskazano pełnemu GPT-Audio, więc tani wariant nie jest kontynuowany pod własną nazwą. Migawkę z października 2025 wyłączono już 23 lipca 2026.