MDL-3476EST.2025 · IDX.568
AudioW produkcji

Deepgram Nova-3

Deepgram · USA · 2025

Koń roboczy transkrypcji korporacyjnej: o połowę mniej błędów niż drugi silnik w kolejce, za ćwierćgrosza za minutę.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Nova-3 pojawił się na początku 2025 roku jako flagowy silnik transkrypcyjny Deepgrama i — inaczej niż modele głosowe, które trafiają na nagłówki — jest tym rodzajem oprogramowania, które po cichu obsługuje infolinie, dyktowanie medyczne i notatki ze spotkań. Własne pomiary Deepgrama dają mu medianę wskaźnika błędu słów na poziomie 6,84 procent przy dźwięku strumieniowym wobec 14,92 procent u drugiego w kolejce konkurenta oraz 5,26 wobec 10 procent w trybie wsadowym; niezależne testy są ostrożniejsze i mówią o 88 do 92 procent trafności na czystym angielskim, czyli mniej więcej tyle, co Whisper i Chirp od Google. Jego pozycję w branży tłumaczą dwie cechy. Transkrybuje dziesięć języków w czasie rzeczywistym i potrafi nadążyć za mówcą, który przełącza się między nimi w połowie zdania — a takie mieszanie języków to codzienność dwujęzycznych domów i międzynarodowych kolejek telefonicznych. Przyjmuje też do stu słów kluczowych podanych przy samym zapytaniu, dzięki czemu nazw leków, numerów części albo firmowego słownika produktów można go nauczyć bez douczania modelu. Rozliczenie idzie za minutę, a model wolno postawić we własnej serwerowni tam, gdzie dźwięk nie może opuścić budynku.

#speech to text#transcription#real time#multilingual#enterprise
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję