MDL-2932EST.2026 · IDX.609
AudioW produkcji

Grok Voice Think Fast 1.0

xAI · United States · 2026

Pierwszy model mowa-w-mowę od xAI — od sierpnia 2026 przestał być domyślny, ale nadal działa i nadal jest tańszy.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Grok Voice Think Fast 1.0 ukazał się 23 kwietnia 2026 roku jako pierwszy model xAI do agentów głosowych czasu rzeczywistego, przesyłający dźwięk w obie strony po połączeniu WebSocket, zamiast składać rozmowę z osobnych usług transkrypcji, modelu językowego i syntezy. Rolę modelu domyślnego pełnił nieco ponad trzy miesiące. 29 lipca 2026 xAI ogłosił wersję 2.0, a 5 sierpnia alias `grok-voice-latest` przeszedł na nią — każda aplikacja, która nie przypięła konkretnego identyfikatora modelu, została zaktualizowana bez żadnego działania właściciela. Wersji 1.0 nie wycofano: programiści mogą wciąż wywoływać `grok-voice-think-fast-1.0`, a powodem, żeby to robić, są pieniądze. Kosztuje 0,05 USD za minutę dźwięku wobec 0,08 USD za nowszy model, czyli o 37% taniej tam, gdzie jakość i tak wystarcza. Różnica między generacjami jest udokumentowana. W indeksie jakości mowa-w-mowę Artificial Analysis wersja 1.0 osiąga 75,7 wobec 82,9 dla następcy, a xAI podaje, że nowszy model uzyskuje 1,4 raza wyższą dokładność transkrypcji na tysiącach krótkich wypowiedzi w 24 językach. Daty wyłączenia wersji 1.0 nie ogłoszono.

#speech to speech#voice agents#real time#previous generation
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję