MDL-6695EST.2026 · IDX.754
category.language-modelW produkcji

Voxtral Mini Transcribe Realtime

Mistral AI · Francja · 2026

Transkrypcja na żywo w otwartym modelu 4 mld parametrów — opóźnienie ustawialne poniżej 200 ms, na tyle mały, że działa lokalnie.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Voxtral Mini Transcribe Realtime, wydany razem z wersją wsadową 4 lutego 2026, zapisuje dźwięk w miarę jak napływa, a nie po zakończeniu nagrania. Opóźnienie da się ustawić poniżej 200 milisekund — czyli progu, poniżej którego asystent głosowy przestaje sprawiać wrażenie, że czeka, aż skończysz, a zaczyna sprawiać wrażenie, że słucha. Model jest celowo mały: 4 miliardy parametrów, i to właśnie czyni wdrożenie lokalne czy brzegowe realnym, a nie życzeniowym. Mistral wydał wagi na licencji Apache 2.0, więc można go uruchomić na laptopie albo na sprzęcie wewnątrz budynku, z którego dźwięk nie ma prawa wyjść — argument rozstrzygający w ochronie zdrowia, obsłudze prawnej i administracji. Przez API kosztuje 0,006 USD za minutę strumienia, czyli dwa razy tyle co wersja wsadowa. Obsługuje te same 13 języków co model wsadowy, ale nie te same funkcje: w trybie czasu rzeczywistego nie działa rozdzielanie mówców, więc zapis na żywo nie powie, kto mówi. Wdrożenia, które potrzebują obu rzeczy, zwykle strumieniują na podgląd, a nagranie przepuszczają potem przez Voxtral Mini Transcribe 2.

#speech-to-text#realtime#open weights#edge#low latency
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję