O Gemini 3.7 Flash foi lançado em 13 de agosto de 2026 como o modelo de trabalho da Google para programação, desenvolvimento web e agentes de IA. Até 31 de dezembro de 2026, a API custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída; em 1º de janeiro de 2027, os preços sobem para U...
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
O Gemini 3.7 Flash é o mais recente modelo de produção da Google voltado a tarefas complexas de programação, desenvolvimento web, uso de ferramentas e fluxos de trabalho com agentes que executam várias etapas. Ele foi lançado em 13 de agosto de 2026 e está disponível pela Gemini API, pelo Google AI Studio, pelo Google Antigravity e pela Gemini Enterprise Agent Platform.
A principal atração do modelo não é liderar todos os rankings de inteligência. A aposta da Google é outra: oferecer capacidade próxima à fronteira, velocidade muito alta e um preço inicial baixo — uma combinação especialmente interessante para desenvolvedores que executam ciclos repetidos de agentes em grande escala.
A Google descreve o Gemini 3.7 Flash como seu modelo de crescimento mais rápido até hoje. No entanto, as informações disponíveis não trazem os números necessários para verificar essa afirmação. Não foram divulgados uma base de usuários, um período de medição, o número de desenvolvedores ativos, o volume de tokens ou um concorrente usado como comparação.
A conclusão mais segura é mais limitada: a Google está posicionando o Flash para conquistar rapidamente desenvolvedores, e o preço promocional baixo, somado à presença em seus produtos para criação e hospedagem de agentes, sustenta essa estratégia. O superlativo sobre crescimento deve ser tratado como uma afirmação não quantificada da empresa, e não como uma estatística de mercado comprovada de forma independente.
Até 31 de dezembro de 2026, as tarifas introdutórias da Gemini API são:
A partir de 1º de janeiro de 2027, entram em vigor as tarifas padrão de US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída — exatamente o dobro dos valores promocionais. As tarifas listadas para modalidades com desconto ou em lote também sobem de US$ 0,375/US$ 1,875 para US$ 0,75/US$ 3,75 por milhão de tokens de entrada/saída.
A data de vencimento é importante para quem está planejando colocar um produto em produção. Um sistema que parece excepcionalmente barato durante o período de lançamento precisa ser recalculado com os preços de 2027 antes de receber uma arquitetura de longo prazo.
O preço por token, porém, é apenas uma parte da conta de um agente. O gasto real depende do tamanho do contexto, das chamadas a ferramentas, das tentativas repetidas, do uso de cache, do nível de raciocínio e do volume de saída. Portanto, o custo anunciado por tarefa em um benchmark não equivale necessariamente ao preço de um fluxo completo em produção.
Em uma análise independente da Artificial Analysis, o Gemini 3.7 Flash obteve 56 pontos no Intelligence Index. O resultado o coloca acima do Claude Sonnet 5, com 55, e logo abaixo do GPT-5.6 Terra, com 57, na comparação citada.
A velocidade é o diferencial mais evidente. A Artificial Analysis mediu aproximadamente 340 tokens de saída por segundo e um índice médio de tempo por tarefa de 1,7, relatando que o Flash é cerca de 40% mais rápido que o GPT-5.6 Terra no nível máximo de raciocínio.
Esses números representam o desempenho medido do modelo ou do provedor, não uma experiência universal em qualquer aplicação. Condições de rede, roteamento, tamanho do prompt, latência das ferramentas e configurações de raciocínio podem alterar o tempo total de resposta.
A Google relata melhorias relevantes em relação ao Gemini 3.6 Flash em engenharia de software, depuração, resolução de problemas, desenvolvimento web e fluxos de trabalho com agentes. Entre os resultados de programação citados estão:
Os resultados apontam para um modelo competente em programação e em agentes que operam pelo terminal, mas não para um vencedor em todas as categorias. O GPT-5.6 Terra continua à frente no resultado citado do Terminal-Bench; a vantagem do Flash está na velocidade e no preço inicial mais baixo.
No nível alto de raciocínio, o ARC Prize registrou os seguintes resultados para o Gemini 3.7 Flash:
São números fortes, especialmente quando considerados junto dos custos informados por tarefa. Ainda assim, o desempenho no ARC-AGI deve ser interpretado como um sinal de capacidade em benchmark, e não como uma previsão direta de confiabilidade em agentes de software. Um agente em produção pode fazer várias chamadas ao modelo, usar ferramentas externas, repetir ações que falharam e processar contextos muito maiores do que os de uma tarefa de teste.
A tabela não é um ranking universal. Os benchmarks foram obtidos em avaliações diferentes, e as fontes não estabelecem um teste único e controlado com todos os modelos. Os preços também podem refletir condições distintas de hospedagem, descontos ou disponibilidade.
As comparações disponíveis indicam uma escolha clara de posicionamento. O Gemini 3.7 Flash está próximo da fronteira no Intelligence Index, mas não tem a maior pontuação: o GPT-5.6 Terra aparece ligeiramente à frente, com 57, e também lidera a comparação citada do Terminal-Bench.
A Google está enfatizando o equilíbrio entre inteligência, latência e custo. Um modelo rápido o suficiente para o desenvolvimento interativo e barato o bastante para ser chamado repetidamente pode ser mais útil em uma plataforma de agentes do que um modelo mais lento e caro que vence um benchmark específico.
Isso é relevante para assistentes de programação, resolução automatizada de problemas, agentes de desenvolvimento web e sistemas que leem contexto, acionam ferramentas, analisam resultados e tentam novamente. Nesse tipo de aplicação, o custo acumulado de cada ciclo pode ser mais importante do que uma pequena diferença em um ranking de inteligência.
A onda de lançamentos de agosto de 2026 torna essa disputa ainda mais acirrada. O Qwen3.8-Max amplia a concorrência em agentes e engenharia de software; GLM-5.3 e Nemotron 3.5 Lightning pressionam em preço e eficiência; enquanto Claude Opus 5 e GPT-5.6 miram capacidades de ponta.
O Gemini 3.7 Flash faz mais sentido como um modelo de trabalho para alto volume do que como o modelo indiscutivelmente mais inteligente do mercado. Seu argumento mais forte combina pontuação 56 no Intelligence Index, geração de aproximadamente 340 tokens por segundo, bons resultados em programação e agentes de terminal e um preço promocional excepcionalmente baixo.
Para desenvolvedores, o principal alerta é financeiro. As tarifas de US$ 0,75/US$ 3,75 terminam em 31 de dezembro de 2026; no dia seguinte, passam a valer US$ 1,50/US$ 7,50. A afirmação da Google sobre crescimento pode se confirmar, mas, sem números de uso que a sustentem, a evidência atual comprova apenas uma estratégia: tornar a inferência rápida e acessível o padrão para aplicações de agentes em escala — não um recorde de adoção já verificado.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O Gemini 3.7 Flash foi lançado em 13 de agosto de 2026 como o modelo de trabalho da Google para programação, desenvolvimento web e agentes de IA.
O Gemini 3.7 Flash foi lançado em 13 de agosto de 2026 como o modelo de trabalho da Google para programação, desenvolvimento web e agentes de IA. Até 31 de dezembro de 2026, a API custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída; em 1º de janeiro de 2027, os preços sobem para US$ 1,50 e US$ 7,50.
O modelo alcançou 95,5% no ARC AGI 1, a US$ 0,12 por tarefa, e 84,6% no ARC AGI 2, a US$ 0,25 por tarefa.