Deepgram Flux
Deepgram · United States · 2025
Rozpoznawanie mowy przebudowane pod rozmowe: samo rozstrzyga, kiedy skonczyles mowic, a nie tylko co powiedziales.
Deepgram uruchomil Flux 2 pazdziernika 2025 roku pod etykieta wlasnego pomyslu — konwersacyjne rozpoznawanie mowy. Roznica jest realna. Klasyczne modele transkrypcyjne buduje sie po to, by zamienic nagranie na tekst mozliwie wiernie; agent glosowy potrzebuje czegos innego, a mianowicie wiedzy o tym, w ktorym momencie czlowiek przestal mowic i czeka na odpowiedz. Te decyzje zwykle dokleja sie pozniej prymitywnym licznikiem ciszy i wlasnie dlatego tyle asystentow glosowych albo wchodzi rozmowcy w slowo, albo zostawia klopotliwa pauze. Flux wbudowuje wykrywanie konca wypowiedzi w sam model rozpoznawania i wydaje werdykt w mniej niz 400 milisekund, obslugujac przy tym wtracenia. 29 kwietnia 2026 roku Deepgram udostepnil powszechnie wersje wielojezyczna: dziesiec jezykow w jednym modelu i — co rzadkie — wykrywanie oraz przelaczanie miedzy nimi w trakcie jednej rozmowy, bez deklarowania jezyka z gory. Model dziala przez chmurowe API Deepgrama z punktami dostepowymi w Europie albo we wlasnej serwerowni, dla organizacji, ktore nie moga wypuscic dzwieku poza wlasna infrastrukture.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!