GPT Live Transcribe
OpenAI · USA · 2026
To samo zadanie co GPT Transcribe, tyle że w trakcie mówienia — i 3,8 raza drożej za minutę właśnie za ten pośpiech.
GPT Live Transcribe wyszedł 28 lipca 2026 roku jako strumieniowa połowa nowej pary modeli transkrypcyjnych OpenAI. GPT Transcribe czeka na gotowe nagranie albo domkniętą turę rozmowy; ten czyta żywy mikrofon, rozmowę telefoniczną czy transmisję i oddaje fragmenty zapisu w miarę, jak padają słowa. Działa wyłącznie w sesjach transkrypcji czasu rzeczywistego — końcówki plikowej nie ma. Po bracie dziedziczy to, co przydatne: swobodny opis tego, o czym jest mowa, podpowiedzi słowne na nazwiska i żargon oraz listę spodziewanych języków zamiast jednego. Własnym dodatkiem jest regulowane opóźnienie — programista sam decyduje, jak długo model może się wahać, zanim zatwierdzi fragment, wymieniając odrobinę zwłoki na odrobinę dokładności. Ciekawa jest cena. Transkrypcja na żywo kosztuje 0,017 USD za minutę wobec 0,0045 USD za to samo nagranie potraktowane jako plik — 3,8 raza drożej za identyczne zadanie, przy czym jedyną różnicą jest natychmiastowość. Stawka jest dokładnie taka sama jak w gpt-realtime-whisper, starszym modelu strumieniowym, który zastępuje: OpenAI obniżyło więc o ćwierć cenę transkrypcji bez pośpiechu, a cenę pracy na żywo zostawiło bez zmian. Wszędzie tam, gdzie tekstu nie trzeba czytać w trakcie mówienia, model plikowy jest odpowiedzią wyraźnie tańszą.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!