IA 360
Actualidad

Google suma tres Gemini Flash mientras Gemini 3.5 Pro sigue pendiente

Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber amplían la familia rápida de Google, con precios que abaratan la salida. El catálogo mantiene Gemini 3.5 Pro como próximo lanzamiento.

4 min de lectura Generado con IA Read in English
Google suma tres Gemini Flash mientras Gemini 3.5 Pro sigue pendiente

El 21 de julio de 2026, Google presentó tres incorporaciones a su familia Gemini: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber. El anuncio dibuja una familia cada vez más especializada: un modelo Flash para trabajo general y agentes, una variante ligera para alto volumen y un modelo centrado en ciberseguridad. A la vez, el catálogo de Google DeepMind conserva junto a Gemini 3.1 Pro una nota escueta: «3.5 Pro coming soon».

Esa frase confirma un estado de disponibilidad, no una explicación de la estrategia de Google. La compañía no ha anunciado en sus materiales públicos por qué el modelo Pro no acompaña a estos tres lanzamientos ni qué fecha tendrá. Convertir esa ausencia en una señal de retirada, retraso o cambio de rumbo sería ir más allá de las fuentes.

Tres papeles dentro de la misma familia

Gemini 3.6 Flash ocupa el lugar de modelo rápido para código, trabajo de conocimiento y tareas multimodales. Google lo presenta en el catálogo como el mejor «en eficiencia de tokens» para esas tareas. Esa descripción importa porque, para una aplicación, el coste no depende solo de cuántos tokens entran y salen: también cuenta cuánto razonamiento y cuántas llamadas a herramientas necesita completar una tarea.

Gemini 3.5 Flash-Lite está pensado para otro extremo del mapa. Google lo orienta a tareas de alto volumen que necesitan eficiencia e inteligencia, pero no necesariamente la profundidad de razonamiento de un modelo Flash más capaz. Es el tipo de opción que encaja en clasificación, extracción, transformaciones repetitivas o subpasos de un flujo de agentes, donde ahorrar latencia y presupuesto por petición puede pesar más que obtener la respuesta más elaborada.

El tercer anuncio, Gemini 3.5 Flash Cyber, introduce una especialización de seguridad. La página de noticias de DeepMind lo anuncia como lanzamiento propio de julio, además de incluirlo en la presentación conjunta. Con la información oficial disponible, conviene describirlo como un modelo de la familia dirigido a ese ámbito, no atribuirle capacidades operativas, evaluaciones o usos de defensa que Google no haya detallado públicamente. Hay además un dato operativo por ausencia: a fecha de esta revisión, Flash Cyber no aparece en la página de precios de la API de Gemini, de modo que quien quiera probarlo no encontrará ahí una tarifa pública como la de sus hermanos.

El catálogo completo ayuda a situar las piezas: junto a los Flash conviven Gemini 3.1 Pro «para tareas complejas y conceptos creativos», Gemini 3.1 Deep Think orientado a ciencia e ingeniería, y una fila de modelos de ecosistema —Omni para multimodalidad, la línea de imagen, audio, robótica y embeddings—. La familia ya no es un modelo con tallas, sino una plantilla con especialistas.

Lo que cuestan y lo que el precio revela

Los precios públicos de la API, consultados el 31 de julio de 2026 en la página oficial de tarifas, cuentan una historia que el anuncio no explicita. Gemini 3.6 Flash cobra 1,50 dólares por millón de tokens de entrada y 7,50 por millón de salida en el nivel estándar. Su predecesor inmediato, Gemini 3.5 Flash, cuesta lo mismo en entrada pero 9,00 en salida. El modelo nuevo no solo promete eficiencia de tokens: sale más barato por token generado que el Flash anterior, un 17% menos en salida.

Flash-Lite materializa el otro extremo: 0,30 dólares por millón de entrada y 2,50 por millón de salida — una quinta parte de la entrada y un tercio de la salida del nuevo 3.6 Flash. Y Gemini 3.1 Pro, el escalón alto disponible, cobra con tarifa doble por encima de los 200.000 tokens de contexto: 2,00 o 4,00 de entrada y 12,00 o 18,00 de salida según el tamaño de la petición. Todos los niveles tienen además un modo por lotes que reduce los precios a la mitad para trabajo que puede esperar. Con la tabla delante, la aritmética de cada caso de uso se vuelve concreta: un millón de tokens de salida en Flash-Lite cuesta lo mismo que unos 139.000 en 3.1 Pro con contexto largo.

Flash no es simplemente «el modelo pequeño»

La etiqueta Flash puede inducir a pensar que solo importa la velocidad. Sin embargo, la documentación de Google para Gemini 3.5 Flash ya situaba esa rama en tareas de agentes, ciclos de programación, uso de herramientas y contextos largos, y hoy lo describe como su modelo «más inteligente para rendimiento de frontera sostenido» en esas tareas. El modelo estable 3.5 Flash ofrece un contexto de entrada de un millón de tokens y hasta 65.000 tokens de salida, con corte de conocimiento en enero de 2025 y la batería completa de herramientas de la plataforma: búsqueda de Google, ejecución de código, contexto de URLs, llamadas a funciones y el uso de ordenador en vista previa.

La nueva división hace más visible una decisión de producto común en los modelos actuales: no hay un único punto óptimo. Un equipo puede querer el modelo más capaz para planificar una tarea compleja, otro más ligero para procesar miles de documentos y una variante especializada cuando el dominio exige conocimientos, pruebas y controles propios. Elegir bien exige medir la calidad en el caso real, la latencia, el coste y los riesgos de cada herramienta — y recordar que el precio por token no es el coste por tarea: un modelo algo más caro que resuelve en una pasada puede salir más barato que uno nominalmente económico que necesita tres intentos y el doble de llamadas a herramientas.

Dónde los verá quien no programa

Los tres nombres no viven solo en la API. En la aplicación de Gemini, la página de suscripciones de Google lista el acceso a 3.6 Flash como el modelo del nivel gratuito, con «acceso variable» al modelo Pro; y la página de ayuda sobre límites describe a Flash-Lite como la salida que Google ofrece cuando una cuenta con plan agota su cuota: continuar la conversación con el modelo más ligero en vez de esperar. La división de la familia también es, en el producto, una escalera de degradación controlada — del Pro al Flash y del Flash al Lite, según capacidad y demanda. La misma familia se compra distinto según la puerta: por tokens en la API, por cuota mensual de cómputo en la aplicación. Cyber, en cambio, no aparece en esos materiales de consumo: su distribución, como su tarifa, queda sin describir públicamente.

Qué significa que Pro esté «próximamente»

Google mantiene Gemini 3.1 Pro para tareas complejas y para desarrollar conceptos creativos, mientras anuncia que 3.5 Pro llegará próximamente. Es una información útil para quien planifique una migración: no conviene diseñar una integración como si ese modelo ya estuviera disponible, ni presupuestarla con precios que aún no existen.

También es una llamada a distinguir catálogo y rumor. Los tres modelos Flash son un lanzamiento verificable, con fichas y —en dos de los tres casos— tarifas públicas; la promesa de 3.5 Pro indica una hoja de ruta, pero no permite anticipar sus prestaciones, precio, fecha ni comparación con los demás. Hasta que Google publique esos datos, la lectura más sólida es menos dramática: está ampliando las opciones Flash mientras mantiene abierto el siguiente escalón Pro. Tres comprobaciones baratas para quien integre estos modelos: fijar el modelo por identificador exacto (gemini-3.6-flash, no «el Flash más nuevo»), medir el caso real con la tarifa por lotes si el trabajo puede esperar, y releer la página de precios en cada versión — los saltos de familia mueven los números sin avisar en el nombre.

Fuentes

Fuentes de esta pieza

Esta pieza se apoya en 4 fuente(s) primaria(s), recogidas durante la investigación.

Este artículo se ha elaborado con inteligencia artificial bajo supervisión editorial humana.

Compartir este artículo

Este sitio web utiliza cookies para mejorar la experiencia de navegación. Política de cookies.

↑↓ navegar ↵ abrir esc cerrar