MDL-3476EST.2025 · IDX.568
AudioW produkcji

Deepgram Nova-3

Deepgram · United States · 2025

Kon roboczy transkrypcji korporacyjnej: o polowe mniej bledow niz drugi silnik w kolejce, za cwiercgrosza za minute.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Nova-3 pojawil sie na poczatku 2025 roku jako flagowy silnik transkrypcyjny Deepgrama i — inaczej niz modele glosowe, ktore trafiaja na naglowki — jest tym rodzajem oprogramowania, ktore po cichu obsluguje infolinie, dyktowanie medyczne i notatki ze spotkan. Wlasne pomiary Deepgrama daja mu mediane wskaznika bledu slow na poziomie 6,84 procent przy dzwieku strumieniowym wobec 14,92 procent u drugiego w kolejce konkurenta oraz 5,26 wobec 10 procent w trybie wsadowym; niezalezne testy sa ostrozniejsze i mowia o 88 do 92 procent trafnosci na czystym angielskim, czyli mniej wiecej tyle, co Whisper i Chirp od Google. Jego pozycje w branzy tlumacza dwie cechy. Transkrybuje dziesiec jezykow w czasie rzeczywistym i potrafi nadazyc za mowca, ktory przelacza sie miedzy nimi w polowie zdania — a takie mieszanie jezykow to codziennosc dwujezycznych domow i miedzynarodowych kolejek telefonicznych. Przyjmuje tez do stu slow kluczowych podanych przy samym zapytaniu, dzieki czemu nazw lekow, numerow czesci albo firmowego slownika produktow mozna go nauczyc bez douczania modelu. Rozliczenie idzie za minute, a model wolno postawic we wlasnej serwerowni tam, gdzie dzwiek nie moze opuscic budynku.

#speech to text#transcription#real time#multilingual#enterprise
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję