Gemini 3.5 Flash
Google DeepMind · USA · 2026
Koń pociągowy Google: milion tokenów kontekstu i cztery poziomy myślenia na półce, za którą programiści realnie płacą.
Gemini 3.5 Flash to model, przez który przechodzi większość ruchu w API Google — nie flagowiec, lecz półka, która musi być szybka, tania i wystarczająco dobra. Ma milion tokenów okna wejściowego, zwraca do 65 tysięcy tokenów i czyta tekst, obrazy, dźwięk, wideo oraz dokumenty. Wyróżnikiem jest pokrętło myślenia z czterema ustawieniami — minimalnym, niskim, średnim i wysokim — w którym domyślne stało się średnie. To ciche przyznanie, że poprzednia generacja wydawała tokeny rozumowania na pytania, które tego nie wymagały. Google ustawia ten model do długiej pracy agentowej i kodowania, a nie do pojedynczych odpowiedzi, i pozwala zachowywać tok rozumowania między turami, żeby długi przebieg agenta nie zaczynał myśleć od zera na każdym kroku. Model jest dostępny w darmowym progu, a w płatnym kosztuje 1,50 dolara za milion tokenów wejścia i 9,00 dolara za milion wyjścia. Warto odnotować datę odcięcia wiedzy: styczeń 2025, czyli wcześniejszą niż rok premiery samego modelu.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!