MDL-3265EST.2026 · IDX.546
AudioW produkcji

GPT Live Transcribe

OpenAI · USA · 2026

To samo zadanie co GPT Transcribe, tyle że w trakcie mówienia — i 3,8 raza drożej za minutę właśnie za ten pośpiech.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

GPT Live Transcribe wyszedł 28 lipca 2026 roku jako strumieniowa połowa nowej pary modeli transkrypcyjnych OpenAI. GPT Transcribe czeka na gotowe nagranie albo domkniętą turę rozmowy; ten czyta żywy mikrofon, rozmowę telefoniczną czy transmisję i oddaje fragmenty zapisu w miarę, jak padają słowa. Działa wyłącznie w sesjach transkrypcji czasu rzeczywistego — końcówki plikowej nie ma. Po bracie dziedziczy to, co przydatne: swobodny opis tego, o czym jest mowa, podpowiedzi słowne na nazwiska i żargon oraz listę spodziewanych języków zamiast jednego. Własnym dodatkiem jest regulowane opóźnienie — programista sam decyduje, jak długo model może się wahać, zanim zatwierdzi fragment, wymieniając odrobinę zwłoki na odrobinę dokładności. Ciekawa jest cena. Transkrypcja na żywo kosztuje 0,017 USD za minutę wobec 0,0045 USD za to samo nagranie potraktowane jako plik — 3,8 raza drożej za identyczne zadanie, przy czym jedyną różnicą jest natychmiastowość. Stawka jest dokładnie taka sama jak w gpt-realtime-whisper, starszym modelu strumieniowym, który zastępuje: OpenAI obniżyło więc o ćwierć cenę transkrypcji bez pośpiechu, a cenę pracy na żywo zostawiło bez zmian. Wszędzie tam, gdzie tekstu nie trzeba czytać w trakcie mówienia, model plikowy jest odpowiedzią wyraźnie tańszą.

#audio#speech-to-text#realtime#api only#multilingual
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję