MDL-7680EST.2026 · IDX.902
Model językowyW produkcji

Mercury 2

Inception · United States · 2026

Model dyfuzyjny, który zrobił z architektury Inception silnik rozumujący: Mercury 2 podaje 1009 tokenów na sekundę na kartach NVIDIA Blackwell, a dziś sprzedawany jest tylko dotychczasowym klientom.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Mercury 2 to model, z którym Inception wyprowadził swoje podejście dyfuzyjne z niszy narzędzi programistycznych do ogólnego rozumowania. Wcześniejsze wydania Mercury adresowano do uzupełniania kodu i czatu; ten ogłoszono jako najszybszy rozumujący model językowy na świecie, a argument stał nie na wynikach testów, lecz na charakterze pracy produkcyjnej. Teza Inception jest taka, że produkcyjna sztuczna inteligencja to dziś nie jedno polecenie i jedna odpowiedź, ale pętle — agenci, potoki wyszukiwania, zadania ekstrakcji — w których opóźnienie nie pojawia się raz, ale kumuluje się na każdym kroku, przy każdym użytkowniku i każdej ponownej próbie. Architektura to ten sam zakład, na którym stoi cała firma. Zamiast dekodować token po tokenie od lewej do prawej, model dopracowuje cały szkic na wszystkich pozycjach jednocześnie i zbiega w niewielkiej liczbie przebiegów. Inception opisuje to jako mniej maszynę do pisania, a bardziej redaktora poprawiającego całą stronę. Opublikowana liczba to 1009 tokenów na sekundę na kartach NVIDIA Blackwell, przy deklarowanym przyspieszeniu ponad pięciokrotnym względem dekodowania sekwencyjnego; NVIDIA dołożyła do komunikatu cytat poparcia, który warto czytać jako to, czym jest — rekomendację dostawcy, a nie niezależny pomiar. Praktyczna wymowa Mercury 2 to kompromis, nie zwycięstwo. Inception nie rości mu pozycji czołowej, a jedynie konkurencyjność względem wiodących modeli optymalizowanych pod szybkość; ciekawsza jest inna teza — że rozumowanie dyfuzyjne dostarcza odpowiedzi o jakości rozumującej w budżecie czasowym aplikacji działającej na żywo, podczas gdy model autoregresyjny musiałby kupić tę jakość dłuższymi łańcuchami i kolejnymi próbami. Model przyjmuje 128 tys. tokenów kontekstu, oddaje do 50 000, a przez zgodne z OpenAI API obsługuje regulowany wysiłek rozumowania, wywołania narzędzi i JSON zgodny ze schematem. Cennik to 0,25 dolara za milion tokenów wejściowych, 0,75 za wyjściowe i 0,025 za wejście z pamięci podręcznej. Wag nie opublikowano. Jego dzisiejszy status wymaga ostrożności, bo dwie strony producenta mówią różnym tonem. Strona modeli ma przypis, że Mercury 1, Mercury 2 i Mercury Edit 2 pozostają wspierane dla dotychczasowych klientów, a dostęp i migracje załatwia przedstawiciel handlowy — w praktyce to drzwi zamknięte dla nowych kont. Dokumentacja dla programistów tymczasem nadal wymienia Mercury 2 z pełną tabelą cen, oknem 128 tys. tokenów i endpointem czatu. Model więc działa i można go rozliczać, ale wejście prowadzi przez konto, które już istnieje, a tym, co firma sprzedaje dzisiaj, jest ogłoszony we wrześniu 2026 r. następca Mercury 2.5 — z czterokrotnie tańszą stawką wejściową i dwukrotnie większym kontekstem.

#proprietary#diffusion LLM#low latency#reasoning#tool use#128K context#USA
Strona oficjalna

Newsy

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję