MDL-2094EST.2026 · IDX.590
category.language-modelW produkcji

Voxtral Mini Transcribe 2

Mistral AI · Francja · 2026

Wsadowy model transkrypcji Mistrala — rozdzielanie mówców, znaczniki czasu przy każdym słowie i nagrania do trzech godzin w 13 językach, za 0,003 USD za minutę.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Voxtral Mini Transcribe 2, wydany 4 lutego 2026, to wsadowa połowa drugiej generacji modeli mowy Mistrala. Powstał do materiału, który już istnieje — nagrań ze spotkań, archiwów call center, wywiadów — a nie do rozmowy na żywo, i przyjmuje do trzech godzin dźwięku w jednym żądaniu. Od zwykłej transkrypcji odróżnia go to, co zwraca obok samych słów. Rozdziela mówców, zaznaczając kto i kiedy mówił — a to właśnie różnica między nieczytelną ścianą tekstu a użytecznym zapisem spotkania czterech osób. Podaje znaczniki czasu przy pojedynczych słowach, więc transkrypcję da się zestawić z nagraniem. Obsługuje też podpowiadanie kontekstu listą do 100 własnych terminów — dzięki temu nazwy produktów, leków czy nazwiska przestają być zapisywane fonetycznie. Zakres to 13 języków: angielski, chiński, hindi, hiszpański, arabski, francuski, portugalski, rosyjski, niemiecki, japoński, koreański, włoski i niderlandzki. Mistral wycenia go na 0,003 USD za minutę nagrania. Bliźniaczy Voxtral Mini Transcribe Realtime obsługuje strumienie na żywo i ma własny profil; w wersji czasu rzeczywistego rozdzielanie mówców nie działa. Punkt końcowy pierwszej generacji Voxtral Mini Transcribe został wyłączony 31 maja 2026.

#speech-to-text#diarization#13 languages#batch
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję