Google wydał 21 lipca trzy nowe modele z rodziny Gemini: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite oraz wyspecjalizowany Gemini 3.5 Flash Cyber. W zestawie zabrakło jednak najbardziej wyczekiwanego wariantu, czyli Gemini 3.5 Pro, który wciąż pozostaje w testach z partnerami. To sygnał, że firma nadrabia zaległości w segmencie tańszych, szybkich modeli, ale w klasie flagowej nadal czeka.
Co dokładnie ogłoszono
Gemini 3.6 Flash to model „roboczy" do kodowania, pracy biurowej i zadań multimodalnych. Według Google zużywa do 17% mniej tokenów wyjściowych niż poprzednik i poprawia wyniki w testach: DeepSWE 49% wobec 37%, MLE Bench 63,9% wobec 49,7%. Cennik to 1,50 USD za milion tokenów wejściowych i 7,50 USD za wyjściowe. Tańszy Gemini 3.5 Flash-Lite (0,30 i 2,50 USD) stawia na przepustowość, czyli 350 tokenów wyjściowych na sekundę, i trafia między innymi do wyszukiwarki Google.
Trzeci model, Gemini 3.5 Flash Cyber, powstał do wykrywania i łatania podatności w kodzie. Na razie jest dostępny wyłącznie dla rządów i zaufanych partnerów w ramach pilotażu CodeMender. Brakującego wariantu Pro, jak podaje Bloomberg, Google nie wydał z powodu wewnętrznych opóźnień i trudności ze spełnieniem własnych celów wydajnościowych. Ostatnia aktualizacja Pro pochodzi z lutego 2026, a konkurencja w tym czasie przyspieszyła: OpenAI wypuściło GPT-5.6, a Anthropic modele Claude Opus 4.8 i Sonnet 5. Google zapowiada już start prac nad modelem Gemini 4.
Co to znaczy dla polskiego biznesu. Nowe modele Flash to przede wszystkim niższy koszt inferencji. Mniej tokenów na zadanie i niższe stawki oznaczają tańsze wdrożenia agentów oraz automatyzacji. Warto jednak liczyć koszt na konkretne, powtarzalne zadanie, a nie tylko cenę za milion tokenów. Brak wersji Pro pokazuje też, że pojedynczy dostawca może mieć luki w ofercie. Architektura model-agnostyczna z routingiem zapytań między modelami chroni przed uzależnieniem od jednego cennika i jednej mapy drogowej.
Źródło: Google (EN), 21 lipca 2026, oraz TechCrunch (EN).



