Gemini 3.8 Flash
Google DeepMind · USA / UK · 2026
Trzecia premiera linii Flash w sześć tygodni: cena jak w 3.7 Flash, ale model celowo zużywa więcej tokenów.
Gemini 3.8 Flash, wydany 2 września 2026 r., to najmocniejszy model Google klasy Flash, ustawiony pod długodystansową pracę programistyczną, agenty autonomiczne i wieloetapowe rozumowanie w zastosowaniach firmowych. Pojawił się trzy tygodnie po Gemini 3.7 Flash i był trzecią premierą linii Flash w sześć tygodni. Technicznie koperta się nie zmieniła: okno wejścia 1 048 576 tokenów, 65 536 tokenów wyjścia, na wejściu tekst, obraz, wideo, audio i PDF, na wyjściu sam tekst, oraz te same trzy poziomy myślenia (niski, średni, wysoki — poziom minimalny zwraca błąd). Jedyny opublikowany wynik testowy to 54,9% w HLE-Verified; przy DeepSWE v1.1, Vals Finance Agent V2 i Harvey's Legal Agent Benchmark Google deklaruje przewagę nad 3.7 Flash i większymi modelami czołowymi, ale liczb nie podaje. Najciekawszy jest koszt. Cennik jest identyczny jak przy 3.7 Flash — 0,75 USD za milion tokenów wejściowych i 3,75 USD za milion wyjściowych — a obie stawki podwajają się 1 stycznia 2027 r., więc to wciąż to samo okno promocyjne, które otworzyło 3.7 Flash, a nie nowa obniżka. Google pisze jednak wprost, że postęp bierze się z tego, że model pracuje ciężej: przy trudnych zadaniach wykonuje dodatkowe kroki rozumowania i wielokrotnie sięga po narzędzia, a „może zużyć więcej tokenów, żeby wycisnąć maksymalną skuteczność, zwłaszcza przy wyższych poziomach wysiłku”. Ta sama stawka nie oznacza więc tego samego rachunku, a firma sama radzi wrażliwym na koszt obniżyć poziom wysiłku albo zostać przy 3.7 Flash, który pozostaje w pełni wspierany. Drugi wariant, Gemini 3.8 Flash Cyber, opiera się na tym samym modelu bazowym, ale nie jest sprzedawany otwarcie: trafia do sprawdzonych obrońców w programie Fairwind — instytucji rządowych, operatorów infrastruktury krytycznej i opiekunów oprogramowania. Osiąga pass@1 47,2% w łataniu podatności CWE-Bench (wobec 47,8% dla czołowego modelu konkurencji, przy znacznie niższym koszcie) i przekracza 70% skuteczności we wewnętrznym teście Google na wykrywanie podatności w 20 językach programowania. Google podaje, że zespół bezpieczeństwa Chrome uzyskał z niego 2,6 raza więcej poprawnych łatek niż z dużo większych modeli komercyjnych, a zespół Cloud Vulnerability Research znalazł dzięki niemu krytyczną podatność fundamentalną w niecałe dwie godziny.
▸Newsy
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!