VolverNoticia
Noticia29 de julio de 20263 min lectura

Lanzamiento de Gemini 3.6 Flash: Mejora en rendimiento y adaptación

R

Ricardo Ospitaletche · Curaduría IA + Revisión Humana

Fuente original: deepmind.google

Lanzamiento de Gemini 3.6 Flash: Mejora en rendimiento y adaptación
Generado con IA

¿Por qué te importa esto?

Gemini 3.6 Flash representa un avance significativo para desarrolladores que buscan optimizar costos y tiempos en tareas de IA. Con una reducción de hasta el 65% en el consumo de tokens en flujos de trabajo complejos, podrás mejorar la eficiencia de tus proyectos y reducir gastos operativos. Esta actualización te permite enfocarte en resultados rápidos sin comprometer el rendimiento.

Google lanza Gemini 3.6 Flash: Más velocidad y menos costos para tus flujos de trabajo

Slug: google-gemini-3-6-flash-lanzamiento Meta description: Conoce Gemini 3.6 Flash, el nuevo modelo de Google que reduce costos y acelera tareas de IA. Detalles, precios y sus versiones Lite y Cyber.

La semana pasada, Google DeepMind sorprendió con una actualización que muchos desarrolladores estaban esperando. El 21 de julio de 2026 se lanzaron oficialmente tres nuevos modelos: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y una edición especializada llamada Gemini 3.5 Flash Cyber.

Si estás construyendo aplicaciones basadas en inteligencia artificial, integrando asistentes o manejando automatizaciones, esta actualización trae un respiro directo a tu presupuesto de API y a los tiempos de respuesta.

El problema que resuelve: La quema de tokens en tareas complejas

Cualquiera que esté creando agentes de IA sabe que las tareas de múltiples pasos (como buscar información, leer un documento, procesar los datos y armar un reporte) consumen una cantidad enorme de tokens. Hasta ahora, el proceso de razonamiento de los modelos implicaba demasiados pasos intermedios, lo que inflaba la factura a fin de mes.

Aquí es donde Gemini 3.6 Flash hace su mejor jugada. Google ajustó el modelo para que necesite menos pasos de razonamiento y menos llamadas a herramientas para llegar al mismo resultado.

¿Qué significa esto en la práctica? El modelo consume un 17% menos de tokens de salida en promedio. Y si usas flujos de trabajo agénticos largos, ese ahorro se dispara hasta un 65%. Logras el mismo objetivo, más rápido y gastando mucho menos.

Precios y disponibilidad inmediata

A diferencia de otros anuncios que prometen lanzamientos a futuro, la familia Flash ya está disponible de forma general en Google AI Studio, la API de Gemini, Android Studio y la app oficial.

El modelo mantiene la enorme ventana de contexto de 1 millón de tokens, pero con precios más agresivos:

  • Tokens de entrada: $1.50 USD por cada millón.
  • Tokens de salida: $7.50 USD por cada millón (una rebaja frente a los $9.00 USD de su versión anterior).

Los hermanos menores y especializados: Lite y Cyber

Junto a la versión principal, Google liberó dos variantes pensadas para necesidades muy específicas:

  1. Gemini 3.5 Flash-Lite: Apunta a la velocidad máxima y al costo mínimo. Por solo $0.30 USD el millón de tokens de entrada y procesando a 350 tokens por segundo, es la opción ideal para tareas de alto volumen y baja latencia, como análisis rápido de textos cortos o enrutamiento de consultas básicas.
  2. Gemini 3.5 Flash Cyber: Un modelo de acceso restringido diseñado exclusivamente para ciberseguridad. Funciona en conjunto con un agente llamado CodeMender para detectar vulnerabilidades en el código, validar parches de seguridad y realizar auditorías automáticas antes de mandar algo a producción.

Si estabas evaluando qué modelo usar para escalar tu próxima herramienta o reducir los costos de la actual, la nueva línea Flash de Google se posiciona como una de las opciones más eficientes que puedes conectar a tu backend hoy mismo.