MDL-1067EST.2025 · IDX.535
AudioW produkcji

Deepgram Flux

Deepgram · United States · 2025

Rozpoznawanie mowy przebudowane pod rozmowe: samo rozstrzyga, kiedy skonczyles mowic, a nie tylko co powiedziales.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Deepgram uruchomil Flux 2 pazdziernika 2025 roku pod etykieta wlasnego pomyslu — konwersacyjne rozpoznawanie mowy. Roznica jest realna. Klasyczne modele transkrypcyjne buduje sie po to, by zamienic nagranie na tekst mozliwie wiernie; agent glosowy potrzebuje czegos innego, a mianowicie wiedzy o tym, w ktorym momencie czlowiek przestal mowic i czeka na odpowiedz. Te decyzje zwykle dokleja sie pozniej prymitywnym licznikiem ciszy i wlasnie dlatego tyle asystentow glosowych albo wchodzi rozmowcy w slowo, albo zostawia klopotliwa pauze. Flux wbudowuje wykrywanie konca wypowiedzi w sam model rozpoznawania i wydaje werdykt w mniej niz 400 milisekund, obslugujac przy tym wtracenia. 29 kwietnia 2026 roku Deepgram udostepnil powszechnie wersje wielojezyczna: dziesiec jezykow w jednym modelu i — co rzadkie — wykrywanie oraz przelaczanie miedzy nimi w trakcie jednej rozmowy, bez deklarowania jezyka z gory. Model dziala przez chmurowe API Deepgrama z punktami dostepowymi w Europie albo we wlasnej serwerowni, dla organizacji, ktore nie moga wypuscic dzwieku poza wlasna infrastrukture.

#speech to text#voice agents#turn taking#real time#multilingual
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję