Mercury Voice
Inception · United States · 2026
Model dyfuzyjny sprzedawany na jednej liczbie: poniżej 170 milisekund do pierwszego tokenu. To pauza, którą słyszy dzwoniący — a Inception jeszcze nie podaje ceny za jej usunięcie.
Mercury Voice to odnoga dyfuzyjnej linii Inception zbudowana pod jedno ograniczenie: agent głosowy nie może myśleć w ciszy. Ogłoszony 8 września 2026 r. jako zapowiedź, razem z flagowym Mercury 2.5, opisywany jest przez producenta jako dLLM zoptymalizowany do agentów głosowych o najostrzejszych budżetach czasowych — i sprzedawany na jednej liczbie: czasie do pierwszego tokenu poniżej 170 milisekund. Tę liczbę warto rozpakować, bo nie jest tym samym co tokeny na sekundę. W rozmowie telefonicznej na żywo przepustowość znaczy mniej niż odstęp, po którym maszyna zaczyna mówić: powyżej około 300 milisekund dzwoniący zaczyna słyszeć pauzę i czytać ją jako wahanie. Teza Inception, wyłożona w komunikacie premierowym, brzmi, że w głosie opóźnienie nie jest szczegółem infrastruktury, ale właśnie pauzą, którą słyszy rozmówca. Firma podpiera ją liczbą klienta, nie pomiarem laboratoryjnym — OpenCall, który prowadzi telefonicznych agentów w realnych rozmowach z klientami, podaje medianę czasu odpowiedzi modelu w okolicach 170 milisekund na swojej pracy produkcyjnej. To liczba podana przez dostawcę za jego własnym klientem. Co model umie poza szybkością, nie jest udokumentowane. Strona modeli producenta daje mu okno 128 tys. tokenów i ten sam zestaw funkcji co flagowcowi — rozumowanie, wywołania narzędzi, wyjście zgodne ze schematem — a jako zastosowania wskazuje obsługę klienta, opiekę nad pacjentem, edukację i gry. Nie ma tabeli wyników, nie ma liczby parametrów, nie ma opublikowanego porównania jakości z ogólnymi modelami Mercury, nie ma wag. Uczciwym nagłówkiem jest tu status handlowy. W przeciwieństwie do Mercury 2.5, który ma publiczny cennik, Mercury Voice nie ma żadnej podanej stawki: sekcja z ceną na stronie producenta to odnośnik do działu sprzedaży, a Inception proponuje w zamian wspólne sprawdzenie, czy model pasuje do konkretnego obciążenia i warunków serwowania. To więc realny produkt dopasowywany do klientów pojedynczo, a nie model, który posiadacz konta może wywołać dziś po południu — i dlatego w tym katalogu stoi jako pilotaż, a nie produkcja. Kto porównuje go z gotowym stosem głosowym, powinien czytać liczbę opóźnienia i brak ceny jako jedno zdanie.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!