To nie tylko dyktowanie. Gemini może także przekształcać zaznaczoną treść lub generować grafiki bezpośrednio w aktywnym oknie . Po włączeniu trybu rozumowania asystent potrafi wykonywać złożone, wieloetapowe zadania za pomocą poleceń głosowych . Na razie funkcja działa w języku angielskim; Google zapowiada obsługę kolejnych języków .
Aktualizacja rozwija natywną aplikację Gemini na macOS zaprezentowaną podczas Google I/O 2026. Wcześniej oferowała ona m.in. pasek czatu wywoływany skrótem Option + Spacja oraz udostępnianie ekranu .
21 lipca 2026 r. Google wypuścił trzy modele: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite oraz wyspecjalizowany model bezpieczeństwa Gemini 3.5 Flash Cyber . Ten ostatni jest przeznaczony dla rządów i zaufanych partnerów w ramach ograniczonego programu pilotażowego . W premierze zabrakło natomiast długo oczekiwanego Gemini 3.5 Pro, który nadal nie został udostępniony .
Oba modele są dostępne od razu, a z aplikacji Gemini można korzystać z nich bezpłatnie . Podane ceny dotyczą interfejsu API, a nie planów konsumenckich.
Gemini Spark — osobisty agent AI Google zapowiedziany podczas I/O 2026 — jest stopniowo udostępniany większej liczbie użytkowników na świecie . Działa w chmurze, więc może kontynuować zadania po zamknięciu laptopa lub zablokowaniu telefonu .
Spark może teraz otwierać i edytować Dokumenty Google, dodawać do nich obrazy, a także modyfikować prywatne i udostępnione arkusze kalkulacyjne oraz prezentacje. Potrafi również odczytywać komentarze i reagować na nie w plikach .
Dzięki funkcji Chrome Auto Browse Spark może — za zgodą użytkownika — korzystać z komputerowej przeglądarki Chrome, w tym z zalogowanych kont i zapisanych haseł . Ma to ułatwiać realizację internetowych spraw, takich jak wyszukiwanie lotów, rozpoczęcie rezerwacji czy umawianie oglądania mieszkania . To wygodne rozwiązanie, ale jednocześnie funkcja wymagająca szczególnej ostrożności przy przyznawaniu dostępu do kont i danych logowania.
W Stanach Zjednoczonych Spark trafia do subskrybentów Google AI Pro kosztującego 20 dol. miesięcznie. W obsługiwanych krajach mogą z niego korzystać także użytkownicy planu Google AI Ultra, którego cena wynosi od 100 do 200 dol. miesięcznie . Funkcja nie jest dostępna dla osób korzystających z bezpłatnej wersji Gemini . Na liście wykluczonych regionów znajdują się m.in. Europejski Obszar Gospodarczy, Szwajcaria, Wielka Brytania i Nigeria . Oznacza to, że określenie „globalna premiera” nie oznacza powszechnej dostępności w każdym kraju.
Ekosystem połączonych aplikacji Gemini został rozszerzony także poza funkcje bezpośrednio związane ze Sparkiem . Agent obsługuje teraz integracje z Canvą, Instacartem i OpenTable . Może również odczytywać i zapisywać informacje w Google Keep oraz Google Tasks .
Google umożliwia ponadto tworzenie własnych połączeń z aplikacjami za pomocą adresów serwerów zgodnych z Model Context Protocol (MCP) . W praktyce ma to pozwolić na podłączanie dodatkowych usług do środowiska Gemini, choć konkretne możliwości będą zależeć od danej integracji.
Nowa funkcja awatarów pozwala zapisać osobisty awatar, a następnie wykorzystywać go przy tworzeniu obrazów . Dzięki temu użytkownik nie musi za każdym razem przesyłać zdjęcia — Gemini może generować treści, w których wizualnie pojawia się dana osoba na podstawie zapisanego awatara .
Spersonalizowane generowanie obrazów, łączące model graficzny Nano Banana z funkcją Personal Intelligence, zostało udostępnione bez opłat wszystkim kwalifikującym się użytkownikom w Stanach Zjednoczonych . Wymagane jest ukończenie 18 lat i zalogowanie się na konto Google. Wcześniej narzędzie było dostępne wyłącznie w płatnych planach Google AI Plus, Pro i Ultra .
Personal Intelligence może korzystać z kontekstu połączonych usług Google, w tym Gmaila, Google Photos, YouTube i wyszukiwarki, aby dopasować obrazy do zainteresowań, stylu życia i osobistych wspomnień użytkownika . Zamiast tworzyć długi opis, można wpisać na przykład „zaprojektuj mój wymarzony dom” albo „stwórz ilustrację przedstawiającą mnie i mojego ulubionego zwierzaka” .
Ta zmiana dotyczy obecnie kwalifikujących się użytkowników w USA, a nie wszystkich użytkowników Gemini na świecie. W przypadku funkcji korzystających z osobistych danych kluczowe pozostają także ustawienia połączonych aplikacji i zgody udzielone przez użytkownika.
Lipcowy Gemini Drop pokazuje, że Google rozwija Gemini w trzech kierunkach jednocześnie: jako asystenta dostępnego w całym systemie, zestaw tańszych modeli dla twórców aplikacji oraz agenta, który sam wykonuje zadania w usługach użytkownika. Najbardziej praktyczne nowości to dyktowanie na macOS i szersza obsługa Workspace. Największe ograniczenia dotyczą natomiast dostępności Spark oraz spersonalizowanych obrazów poza Stanami Zjednoczonymi.