Google lanza Gemini 3.6 Flash y 3.5 Flash-Lite: ¿Cuál elegir para tus agentes de IA?
Google DeepMind acaba de sacudir el tablero este 21 de julio de 2026 con una nueva actualización de su familia Gemini. Atrás quedaron las promesas genéricas; la nueva línea se divide estratégicamente en tres modelos muy específicos: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, y un misterioso 3.5 Flash Cyber.
Si estás armando flujos de trabajo automatizados o programando agentes en Python usando frameworks como LangGraph, n8n o CrewAI, entender la diferencia entre estas versiones te va a ahorrar bastantes dolores de cabeza (y dinero) en la factura de la API.
Aquí te explico frente a frente qué trae cada uno y dónde brillan.
Gemini 3.6 Flash: El nuevo motor principal
Este es el modelo que Google quiere que uses para la mayor parte de tus tareas de desarrollo y conocimiento.
- La ventaja: Reduce el consumo de tokens de salida en un 17% en comparación con la versión 3.5. Esto soluciona de raíz el problema de las respuestas excesivamente largas que muchos desarrolladores venían reportando.
- Casos de uso: Ideal para orquestar agentes complejos, analizar documentos largos y programación pura. Se lleva muy bien con tareas multimodales, como extraer datos de gráficos complejos.
- El costo: $1.50 por millón de tokens de entrada y $7.50 por los de salida.
Gemini 3.5 Flash-Lite: Velocidad bruta a bajo costo
Si el 3.6 es el cerebro de la operación, el Flash-Lite es el trabajador incansable para tareas de volumen.
- La ventaja: Es ridículamente rápido. Logra escupir hasta 350 tokens por segundo.
- Casos de uso: Pensado específicamente como un "subagente". Si tienes un proceso que clasifica miles de correos, extrae datos de facturas en lote o realiza traducciones masivas, este es tu modelo.
- El costo: Apenas $0.30 por millón de tokens de entrada y $2.50 de salida. Una verdadera ganga para escalar operaciones sin quebrar el banco.
Gemini 3.5 Flash Cyber: El club exclusivo
Aquí hay que desmentir un rumor: este modelo no está abierto al público.
- ¿Qué es? Es una versión ultra especializada en encontrar, validar y reparar vulnerabilidades de código.
- Disponibilidad: Google lo lanzó como un piloto restringido únicamente para gobiernos y socios de confianza a través de su plataforma CodeMender. Es una medida para evitar que una herramienta de ciberseguridad tan potente caiga en manos equivocadas.
¿Cómo quedan frente a la competencia?
Con esta movida, Google se planta fuerte. Mientras modelos como GPT-5.6 Sol o Claude Fable 5 siguen liderando en razonamiento extremadamente profundo (a un precio mayor), la familia Flash domina en la relación velocidad-costo. Para quienes despliegan aplicaciones reales en producción hoy, la estrategia ganadora parece clara: usar el Flash-Lite para el trabajo sucio y repetitivo, el 3.6 Flash para la lógica del agente principal, y reservar los modelos más caros y lentos solo para cuellos de botella críticos.
