Debiut Google Gemini 3.7 Flash z lepszą obsługą zadań wieloetapowych

Google oficjalnie wprowadziło na rynek nowy model sztucznej inteligencji Gemini 3.7 Flash, który od pierwszego dnia zasila chmurowego agenta Gemini Spark. Rozwiązanie przynosi znaczące usprawnienia w planowaniu procesów wieloetapowych, obsłudze zewnętrznych narzędzi oraz integracji ze środowiskiem Google Workspace. Aktualizacja zapewnia również zauważalną redukcję kosztów tokenów w zestawieniu z konkurencyjnymi platformami na rynku.

Gemini 3.7 Flash trafił bezpośrednio do agenta Gemini Spark. Przekłada się to na znacznie lepsze radzenie sobie ze złożonymi procedurami oraz efektywniejsze wykorzystanie dostępnych narzędzi. Google wskazuje przede wszystkim na sprawniejsze scalanie plików, przygotowywanie wersji roboczych wiadomości elektronicznych oraz aktualizowanie dokumentów statusowych w ramach pakietu biurowego.

Asystent chmurowy potrafi kontynuować zlecone operacje w tle, nawet po zamknięciu pokrywy laptopa lub zablokowaniu ekranu smartfona. Rozwiązanie bez przeszkód funkcjonuje w obrębie usług takich jak Gmail, Dysk, Dokumenty, Kalendarz, Keep oraz Tasks. Dodatkowo producent rozszerzył te możliwości za pośrednictwem przeglądarki Chrome, gdzie asystent korzysta z zalogowanych kont oraz zapisanych haseł.

Dzięki temu agent może samodzielnie przeszukiwać witryny internetowe, porównywać połączenia lotnicze, planować wizyty czy rozpoczynać rezerwacje. Przed wykonaniem wrażliwych operacji, w tym autoryzacji płatności, system zawsze przekazuje kontrolę użytkownikowi. Nowy model poświęca więcej zasobów na planowanie sekwencji działań, co redukuje liczbę błędów i eliminuje potrzebę ręcznej interwencji.

 

Wyniki testów wydajnościowych oraz cennik

Przewaga technologiczna nowego rozwiązania znajduje potwierdzenie w benchmarkach. W teście AutomationBench Gemini 3.7 Flash uzyskał wynik 30,4%, podczas gdy poprzednik Gemini 3.6 Flash osiągnął 17%. Dla porównania konkurencyjny model GPT 5.6 Terra zdobył 23,6%, a Claude Sonnet 5 zaledwie 10,7%.

Wyraźny postęp widać również w przetwarzaniu obszernych dokumentów. W sprawdzianie GDP.pdf model od Google osiągnął 34%, wyprzedzając Claude Sonnet 5 z rezultatem 28%, GPT 5.6 Terra z wynikiem 24,7% oraz Gemini 3.6 Flash mający 22%. W testach programistycznych FrontierCode nowy system wygenerował wynik 43,6%, plasując się przed Claude Sonnet 5 (42,7%) i GPT 5.6 Terra (41,3%), wykazując jednocześnie progres w teście DeepSWE.

Wdrożenie charakteryzuje się bardzo konkurencyjną strukturą kosztów obowiązującą do 31 grudnia. Cena wynosi 0,75 USD za milion tokenów wejściowych oraz 3,75 USD za milion tokenów wyjściowych. Claude Sonnet 5 wyceniany jest na 2 USD i 10 USD, natomiast GPT 5.6 Terra kosztuje odpowiednio 2 USD oraz 12 USD.

Dla użytkowników agenta Spark premiera oznacza wyraźnie stabilniejszą pracę, choć zaawansowani odbiorcy biznesowi wciąż oczekują na flagowy model Gemini 3.5 Pro. Wersja ta została zapowiedziana w maju podczas konferencji Google I/O, lecz po opuszczeniu planowanego czerwcowego terminu wdrożenia nie trafiła jeszcze do oficjalnej dystrybucji.