GPT-Audio
OpenAI · USA · 2025
Cichy bliźniak GPT-Realtime: ten sam głos bez transmisji na żywo — dźwięk dla aplikacji, które odpowiadają bez pośpiechu.
GPT-Audio, wydany razem z GPT-Realtime 28 sierpnia 2025 roku, to model, o którym większość korzystających z głosowej oferty OpenAI nigdy nie słyszy. Model czasu rzeczywistego trzyma otwarte połączenie i wchodzi sobie w słowo jak człowiek; ten przyjmuje gotowy plik dźwiękowy, przetwarza go i oddaje gotową odpowiedź przez zwykłe chat completions — to samo wywołanie, którego programiści używają do tekstu. Nadaje się więc tam, gdzie nikt nie czeka na linii: do analizy nagranej rozmowy, streszczenia wiadomości głosowej, wygenerowania lektora. Bilans wypada odwrotnie, niż można by sądzić, i to na jego korzyść: mieści 128 tysięcy tokenów kontekstu wobec 32 tysięcy modelu czasu rzeczywistego i oddaje do 16 384 tokenów wobec 4096. Na wejściu przyjmuje tekst i dźwięk, na wyjściu mówi i pisze, a jego wiedza kończy się 1 października 2023 roku. 20 lipca 2026 roku OpenAI wpisało go na listę wycofań razem z siedmioma innymi modelami głosowymi; przestaje odpowiadać 20 stycznia 2027, a następcą wskazano gpt-audio-1.5.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!