A ferramenta não fica limitada à transcrição. O usuário também pode selecionar um conteúdo para pedir que o Gemini o transforme ou gerar imagens e outros elementos visuais no local em que o cursor estiver . Com o modo de raciocínio ativado, o assistente pode executar tarefas complexas com várias etapas usando apenas comandos de voz .
Por enquanto, o ditado inteligente está disponível em inglês; o Google promete adicionar outros idiomas . A novidade amplia o aplicativo nativo do Gemini para macOS apresentado no Google I/O 2026, que já oferecia uma barra de conversa aberta pelo atalho Option + Espaço e compartilhamento de tela .
Em 21 de julho de 2026, o Google lançou três modelos: o Gemini 3.6 Flash, voltado a tarefas gerais; o Gemini 3.5 Flash-Lite, otimizado para custo e velocidade; e o Gemini 3.5 Flash Cyber, um modelo de segurança com acesso restrito . O lançamento aconteceu sem o aguardado Gemini 3.5 Pro, que continua sem data de lançamento confirmada .
O Gemini 3.6 Flash é apresentado como o modelo principal para tarefas de trabalho. Ele melhora o desempenho em programação, recursos multimodais e atividades de conhecimento, usando até 17% menos tokens que o Gemini 3.5 Flash anterior .
Na API, o preço é de US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída — abaixo dos US$ 9,00 cobrados pela geração anterior na saída . O modelo tem janela de contexto de 1 milhão de tokens e corte de conhecimento em março de 2026 .
Ele está disponível na Gemini API, no Google AI Studio, no Android Studio, no aplicativo Gemini, no Google Antigravity e no aplicativo Gemini Enterprise .
O Flash-Lite foi projetado para tarefas que exigem baixa latência e alto volume, como pesquisa feita por agentes e processamento de documentos . Segundo o Google, é o modelo mais rápido e econômico da classe 3.5, com geração de 350 tokens por segundo .
O preço é de US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída . Assim como o 3.6 Flash, ele oferece uma janela de contexto de 1 milhão de tokens e também está chegando à Busca do Google, além da Gemini API e do aplicativo Gemini .
Os dois modelos estão disponíveis imediatamente e podem ser usados gratuitamente dentro do aplicativo Gemini .
O Gemini Spark, agente pessoal de IA apresentado pela primeira vez no Google I/O 2026, está sendo liberado globalmente para assinantes . Diferentemente de um chatbot que só responde quando é aberto, o Spark funciona na nuvem e pode continuar executando tarefas mesmo depois que o usuário fecha o notebook ou bloqueia o celular .
Entre as principais novidades estão:
A expansão não inclui o Espaço Econômico Europeu, a Suíça, o Reino Unido e a Nigéria .
Além dos recursos específicos do Spark, o aplicativo Gemini também ampliou seu ecossistema de integrações .
O Spark passou a oferecer suporte a aplicativos conectados como Canva, Instacart e OpenTable . Ele também consegue ler e editar informações do Google Keep e do Google Tasks . Para quem precisa conectar serviços próprios ou outras ferramentas, o Google oferece suporte a conexões personalizadas por meio do Model Context Protocol (MCP), um padrão que permite a aplicativos externos disponibilizar funções para agentes de IA .
O Gemini ganhou uma opção para criar e salvar um avatar pessoal. Depois de configurado, o usuário pode pedir para ser incluído em imagens sem precisar enviar uma nova foto a cada solicitação .
O sistema usa esse avatar salvo para gerar conteúdos visualmente compatíveis com a aparência do usuário . Na prática, o recurso reduz uma das etapas mais trabalhosas de prompts que envolvem a própria pessoa: repetir o upload de imagens de referência.
A geração personalizada de imagens do Gemini, que combina o modelo visual Nano Banana com os recursos de Personal Intelligence, passou a ser gratuita para todos os usuários elegíveis nos Estados Unidos . A oferta vale para pessoas com 18 anos ou mais que estejam conectadas a uma conta pessoal do Google .
Antes, o recurso estava limitado aos assinantes dos planos Google AI Plus, Pro e Ultra. Agora, ele pode usar informações de aplicativos conectados — como Gmail, Google Fotos, YouTube e Busca — para produzir imagens alinhadas aos interesses, ao estilo de vida e às memórias do usuário .
Isso permite fazer pedidos mais simples, como “crie a casa dos meus sonhos” ou “faça uma ilustração minha com meu animal de estimação favorito”, sem descrever todos os detalhes manualmente . Como o Gemini pode recorrer a fotos do Google Fotos, também não é necessário anexar uma imagem nova sempre que a criação incluir o usuário .
O Gemini Drop de julho de 2026 combina três movimentos: modelos mais baratos para desenvolvedores, uma interface de voz que atravessa aplicativos e agentes capazes de agir no lugar do usuário. O Spark é o exemplo mais claro dessa mudança, já que não apenas produz respostas, mas também edita arquivos, navega na web e trabalha em segundo plano.
Ao mesmo tempo, a disponibilidade ainda varia bastante. O Spark permanece restrito a planos pagos e a determinados mercados, enquanto a geração personalizada de imagens gratuita foi anunciada especificamente para usuários elegíveis nos Estados Unidos. Para o público de outros países, o acesso depende da expansão gradual de cada recurso e das condições definidas pelo Google.