Google lança Gemini 3.6 Flash: Mais velocidade e menos custos para seus fluxos de trabalho
Slug: google-gemini-3-6-flash-lançamento
Meta description: Conheça o Gemini 3.6 Flash, o novo modelo do Google que reduz custos e acelera tarefas de IA. Detalhes, preços e suas versões Lite e Cyber.
Na semana passada, o Google DeepMind surpreendeu com uma atualização que muitos desenvolvedores estavam aguardando. Em 21 de julho de 2026, foram lançados oficialmente três novos modelos: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e uma edição especializada chamada Gemini 3.5 Flash Cyber.
Se você está construindo aplicativos baseados em inteligência artificial, integrando assistentes ou gerenciando automações, esta atualização traz um alívio direto para o seu orçamento de API e para os tempos de resposta.
O problema que resolve: A queima de tokens em tarefas complexas
Qualquer um que esteja criando agentes de IA sabe que as tarefas de múltiplos passos (como buscar informações, ler um documento, processar os dados e montar um relatório) consomem uma quantidade enorme de tokens. Até agora, o processo de raciocínio dos modelos envolvia passos intermediários demais, o que inflava a fatura no final do mês.
É aqui que o Gemini 3.6 Flash faz sua melhor jogada. O Google ajustou o modelo para que precise de menos passos de raciocínio e menos chamadas a ferramentas para chegar ao mesmo resultado.
O que isso significa na prática? O modelo consome em média 17% menos tokens de saída. E se você usar fluxos de trabalho de agentes longos, essa economia dispara para até 65%. Você alcança o mesmo objetivo, mais rápido e gastando muito menos.
Preços e disponibilidade imediata
Ao contrário de outros anúncios que prometem lançamentos futuros, a família Flash já está disponível de forma geral no Google AI Studio, na API do Gemini, no Android Studio e no aplicativo oficial.
O modelo mantém a enorme janela de contexto de 1 milhão de tokens, mas com preços mais agressivos:
- Tokens de entrada: $1,50 USD por cada milhão.
- Tokens de saída: $7,50 USD por cada milhão (uma redução em relação aos $9,00 USD da sua versão anterior).
Os irmãos menores e especializados: Lite e Cyber
Junto com a versão principal, o Google lançou duas variantes pensadas para necessidades muito específicas:
- Gemini 3.5 Flash-Lite: Foca na velocidade máxima e no custo mínimo. Por apenas $0,30 USD por milhão de tokens de entrada e processando a 350 tokens por segundo, é a opção ideal para tarefas de alto volume e baixa latência, como análise rápida de textos curtos ou roteamento de consultas básicas.
- Gemini 3.5 Flash Cyber: Um modelo de acesso restrito projetado exclusivamente para cibersegurança. Funciona em conjunto com um agente chamado CodeMender para detectar vulnerabilidades no código, validar patches de segurança e realizar auditorias automáticas antes de enviar algo para produção.
Se você estava avaliando qual modelo usar para escalar sua próxima ferramenta ou reduzir os custos da atual, a nova linha Flash do Google se posiciona como uma das opções mais eficientes que você pode conectar ao seu backend hoje mesmo.
