VoltarNotícia
Notícia29 de julho de 20263 min leitura

Lançamento do Gemini 3.6 Flash: Melhora de desempenho e adaptação

R

Ricardo Ospitaletche · Curadoria IA + Revisão Humana

Fonte original: deepmind.google

Lançamento do Gemini 3.6 Flash: Melhora de desempenho e adaptação
Gerado com IA

Por que isso importa para você?

O Gemini 3.6 Flash representa um avanço significativo para desenvolvedores que buscam otimizar custos e tempos em tarefas de IA. Com uma redução de até 65% no consumo de tokens em fluxos de trabalho complexos, você poderá melhorar a eficiência dos seus projetos e reduzir despesas operacionais. Esta atualização permite que você se concentre em resultados rápidos sem comprometer o desempenho.

Google lança Gemini 3.6 Flash: Mais velocidade e menos custos para seus fluxos de trabalho

Slug: google-gemini-3-6-flash-lançamento
Meta description: Conheça o Gemini 3.6 Flash, o novo modelo do Google que reduz custos e acelera tarefas de IA. Detalhes, preços e suas versões Lite e Cyber.

Na semana passada, o Google DeepMind surpreendeu com uma atualização que muitos desenvolvedores estavam aguardando. Em 21 de julho de 2026, foram lançados oficialmente três novos modelos: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e uma edição especializada chamada Gemini 3.5 Flash Cyber.

Se você está construindo aplicativos baseados em inteligência artificial, integrando assistentes ou gerenciando automações, esta atualização traz um alívio direto para o seu orçamento de API e para os tempos de resposta.

O problema que resolve: A queima de tokens em tarefas complexas

Qualquer um que esteja criando agentes de IA sabe que as tarefas de múltiplos passos (como buscar informações, ler um documento, processar os dados e montar um relatório) consomem uma quantidade enorme de tokens. Até agora, o processo de raciocínio dos modelos envolvia passos intermediários demais, o que inflava a fatura no final do mês.

É aqui que o Gemini 3.6 Flash faz sua melhor jogada. O Google ajustou o modelo para que precise de menos passos de raciocínio e menos chamadas a ferramentas para chegar ao mesmo resultado.

O que isso significa na prática? O modelo consome em média 17% menos tokens de saída. E se você usar fluxos de trabalho de agentes longos, essa economia dispara para até 65%. Você alcança o mesmo objetivo, mais rápido e gastando muito menos.

Preços e disponibilidade imediata

Ao contrário de outros anúncios que prometem lançamentos futuros, a família Flash já está disponível de forma geral no Google AI Studio, na API do Gemini, no Android Studio e no aplicativo oficial.

O modelo mantém a enorme janela de contexto de 1 milhão de tokens, mas com preços mais agressivos:

  • Tokens de entrada: $1,50 USD por cada milhão.
  • Tokens de saída: $7,50 USD por cada milhão (uma redução em relação aos $9,00 USD da sua versão anterior).

Os irmãos menores e especializados: Lite e Cyber

Junto com a versão principal, o Google lançou duas variantes pensadas para necessidades muito específicas:

  1. Gemini 3.5 Flash-Lite: Foca na velocidade máxima e no custo mínimo. Por apenas $0,30 USD por milhão de tokens de entrada e processando a 350 tokens por segundo, é a opção ideal para tarefas de alto volume e baixa latência, como análise rápida de textos curtos ou roteamento de consultas básicas.
  2. Gemini 3.5 Flash Cyber: Um modelo de acesso restrito projetado exclusivamente para cibersegurança. Funciona em conjunto com um agente chamado CodeMender para detectar vulnerabilidades no código, validar patches de segurança e realizar auditorias automáticas antes de enviar algo para produção.

Se você estava avaliando qual modelo usar para escalar sua próxima ferramenta ou reduzir os custos da atual, a nova linha Flash do Google se posiciona como uma das opções mais eficientes que você pode conectar ao seu backend hoje mesmo.