Gemini 3.8 Flash y Cyber llegan para agentes y seguridad

Qué es el Gemini 3.8 Flash
Google lanzó el Gemini 3.8 Flash y la variante Gemini 3.8 Flash Cyber el 02/09/2026, según el anuncio oficial en The Keyword. El precio de introducción es el mismo del 3.7 Flash, US$ 0,75 y US$ 3,75 por millón de tokens, y expira el 31/12/2026; a partir del 01/01/2027 se duplica.
Publicado el 10/09/2026. El evento es del 02/09/2026; los precios, los plazos y los benchmarks siguen la lectura de la fuente primaria en esta fecha.
Ocho días separan el anuncio de este análisis, y la distancia es deliberada. La noticia de un lanzamiento se agota en un día; lo que permanece es la decisión que el lanzamiento obliga a tomar. La decisión que deja este anuncio tiene tres frentes, todos con fecha o número publicado: el plazo del precio introductorio, el dial de esfuerzo que modifica el costo por tarea y el acceso restringido a la variante Cyber. Cada uno de ellos cambia la hoja de cálculo de quien consume modelos vía API.
Qué ocurrió
El anuncio del 02/09/2026, firmado por Tulsee Doshi y Raluca Ada Popa, de Google DeepMind, presenta dos modelos. El Gemini 3.8 Flash es el modelo de trabajo para ingeniería de software, tareas agénticas y razonamiento de varios pasos. El Gemini 3.8 Flash Cyber es la variante de ciberseguridad, con acceso restringido al programa Fairwind.
Salió en The Keyword a las 15:00 UTC del 02/09/2026. Un post, dos modelos, dos regímenes de acceso: uno abierto por los canales habituales de API, otro cerrado dentro de un programa de confianza. La asimetría entre los dos es el dato de enrutamiento más importante del anuncio.
El Gemini 3.8 Flash está disponible en los canales que Google lista: la Gemini API con AI Studio, Google Antigravity, Android Studio, Stitch y Gemini Enterprise, además de las apps Gemini para suscriptores Pro y Ultra. La lista es un hecho del evento del 02/09. Lo que cada empresa hace con ella, dónde entra el modelo en el mix y en qué ruta, es una decisión propia.
La variante Cyber no entra en ese circuito abierto. Según la página del modelo en Google DeepMind y el post oficial del programa Fairwind, el acceso es exclusivo de Fairwind, destinado a autoridades gubernamentales confiables, operadores de infraestructura crítica y mantenedores de software. El anuncio registra que la Cyber opera con mitigaciones más permisivas, viabilizadas por el acceso restringido. La fuente primaria no divulga precio público para la Cyber.
La cadencia también es un hecho: es el tercer lanzamiento de la línea Flash en seis semanas. El 3.7 Flash llegó tres semanas antes y sigue soportado para cargas efficiency-first, según el mismo anuncio. No es el primer evento de Gemini que cubrimos aquí; el anterior, de video agéntico y consumo de tokens, está en el análisis del video agéntico en Gemini. Quien recibe un modelo nuevo cada tres semanas necesita un proceso de evaluación, y el proceso empieza por el costo.
Por qué importa
Para el CFO, el precio introductorio tiene fecha de vencimiento: expira el 31/12/2026 y se duplica el 01/01/2027. Para el CTO, el costo por tarea ganó un dial de esfuerzo, y el consumo de tokens pasa a variar con la configuración. Para el CEO, la ruta de seguridad de frontera se volvió una cuestión de acceso, no de elección de modelo.
El Gemini 3.8 Flash entra a US$ 0,75 por millón de tokens de entrada y US$ 3,75 por millón de tokens de salida, el mismo precio introductorio del 3.7 Flash. La nota al pie oficial del anuncio cierra el plazo: el 31/12/2026 expira el nivel introductorio y, a partir del 01/01/2027, valen US$ 1,50 y US$ 7,50. La cifra de enero es el doble de la cifra de septiembre.
La aritmética directa de los precios publicados: un workload de 100 millones de tokens de entrada y 20 millones de salida por mes paga US$ 150 por mes en el régimen introductorio y US$ 300 a partir del 01/01/2027. Es raro que un fabricante entregue la fecha del aumento junto con el precio bajo. Aquí la fecha vino en la nota al pie, y la línea de costo de 2027 del presupuesto ya tiene número. El precio como argumento de enrutamiento tiene capítulo propio en este blog: costo de modelos de IA como argumento de enrutamiento.
La capacidad prometida viene con números del fabricante. En DeepSWE v1.1, benchmark de ingeniería de software long-horizon, Google afirma que el 3.8 Flash supera a la mayoría de los modelos de frontera más grandes por una fracción del costo. El modelo puntúa 54,9% en HLE-Verified y aparece en los tableros agénticos Vals Finance Agent V2 y Harvey's Legal Agent Benchmark. Todo del anuncio del 02/09/2026, no de una evaluación independiente; entran en la decisión como tesis por validar, no como hecho cerrado.
El dial de esfuerzo es el cambio operacional. En tareas complejas, el modelo ejecuta pasos extra de razonamiento y llama herramientas de forma iterativa, y en los niveles de esfuerzo altos Google advierte que el consumo de tokens sube; los niveles menores minimizan el overhead. El costo por tarea deja de ser un derivado pasivo del precio por token y pasa a ser configuración. Quien mide costo por tarea ya mide lo que importa; quien mide solo el precio del token medirá la variable equivocada en 2027. Para el lector que llega ahora al tema, el explicador de gateway y router de IA cubre el papel de la capa que decide qué modelo responde cada llamada.
Del lado de la seguridad, el 3.8 Flash general trae una ganancia de robustez frente a prompt injection medida por Gray Swan y salvaguardas CBRN y cyber offense conforme al Frontier Safety Framework. El mismo paquete del anuncio reporta impacto en producción: el equipo de seguridad de Chrome registró 2,6x más parches correctos que los mejores modelos comerciales mucho más grandes, Wiz midió de +7,5% a 9,7% de recall en un benchmark interno de pentest a un costo 2,3x a 5,2x menor, y el equipo de Cloud Vulnerability Research encontró una vulnerabilidad crítica en menos de 2 horas, contra meses en el proceso usual. Números del fabricante, en casos que el fabricante eligió. El detalle que cambia la decisión de ruta está en el acceso.
El modelo detrás de ese frente de seguridad no tiene precio público ni canal abierto. La variante Cyber es exclusiva del programa Fairwind, para autoridades gubernamentales confiables, operadores de infraestructura crítica y mantenedores de software, y la fuente primaria no informa criterios de expansión ni plazo. La seguridad de frontera dejó de ser una elección de modelo y pasó a ser también una cuestión de acceso. Quien encaja en el perfil tiene una ruta por evaluar; quien no encaja enruta con el 3.8 Flash general y con los controles de su propia capa de gateway, tema del gateway corporativo de enrutamiento y seguridad.
Qué cambia en la práctica
El régimen de decisión cambia en cuatro líneas: el precio sigue en US$ 0,75 y US$ 3,75, pero ahora con plazo anunciado; el costo por tarea gana el dial de esfuerzo; el acceso a la variante Cyber pasa por Fairwind; y la robustez de los agentes pasa a tener métrica divulgada, con Gray Swan midiendo prompt injection.
La tabla compara el régimen 3.7 con el régimen 3.8 en los cuatro frentes que cambian la hoja de decisión.
| Decisión | Régimen 3.7 (antes) | Régimen 3.8 (después) |
|---|---|---|
| Precio y vigencia | US$ 0,75 y US$ 3,75 por millón de tokens, precio introductorio vigente | El mismo precio, ahora con plazo: expira el 31/12/2026 y se duplica a US$ 1,50 y US$ 7,50 el 01/01/2027 |
| Costo por tarea | Se lee como precio por token, la variable de costo del anuncio de la línea | Dial de esfuerzo: los niveles altos consumen más tokens, con razonamiento extra y llamadas iteradas de herramientas; los niveles menores minimizan el overhead |
| Disponibilidad de la Cyber | La generación anterior (3.5 Flash Cyber) citada en un benchmark del anuncio, sin programa de acceso nombrado en esta pieza | Exclusiva de Fairwind: autoridades gubernamentales confiables, operadores de infraestructura crítica y mantenedores de software |
| Robustez de agentes | Sin métrica divulgada de prompt injection en la generación anterior | Ganancia significativa medida por Gray Swan, con salvaguardas CBRN y cyber offense del Frontier Safety Framework |
El precio es la línea que vence primero. El régimen introductorio termina el 31 de diciembre de 2026, y la nota al pie del anuncio fija el nivel de 2027: US$ 1,50 por millón de tokens de entrada y US$ 7,50 de salida.
Se duplica en ambos lados.
Quien monte arquitectura y contrato sobre el precio de septiembre va a reabrir la hoja de cálculo en enero. La diferencia es que el plazo estaba escrito desde el primer día, y un precio con vigencia anunciada es condición de contrato, no sorpresa de factura.
La tabla tiene un límite que conviene nombrar: los benchmarks que sostienen la línea de la capacidad son del fabricante. El DeepSWE v1.1, el CyberGym y el CWE-Bench miden lo que Google dice que los modelos hacen, según la lectura del anuncio del 02/09/2026. La validación independiente queda para después. El router que espere por ella no pierde el plazo del precio; el plazo es del calendario, no del tablero.
Qué hacer ahora
Cinco decisiones concentran el valor práctico del lanzamiento: anclar el presupuesto de 2027 al precio de enero, configurar el nivel de esfuerzo por workload, decidir el encuadre frente a Fairwind, revisar las cargas que siguen en el 3.7 Flash y validar los benchmarks del fabricante con carga propia. La lista, en orden de plazo.
- Ancle el presupuesto de 2027 al precio del 01/01/2027. US$ 1,50 y US$ 7,50 por millón de tokens son las cifras que valen en la planeación; el nivel introductorio de US$ 0,75 y US$ 3,75 es una ventana hasta el 31/12/2026. Un workload de US$ 150 por mes en el régimen actual cuesta US$ 300 en enero, por la aritmética de los precios publicados.
- Defina el nivel de esfuerzo por workload, no por cuenta. Los niveles altos se pagan en tareas agénticas complejas, donde el modelo itera herramientas y ejecuta razonamiento extra; los niveles menores minimizan el overhead donde la factura está dominada por volumen. Esa configuración es la variable nueva del costo por tarea.
- Clasifique a la organización frente a Fairwind. Las autoridades gubernamentales confiables, los operadores de infraestructura crítica y los mantenedores de software tienen una ruta de seguridad por evaluar con la variante Cyber. Fuera de ese perfil, la ruta es el 3.8 Flash general con los controles de gateway de la propia empresa.
- Revise las cargas efficiency-first en el 3.7 Flash. El modelo sigue soportado, según el anuncio, y la decisión de migrar pasa por el dial de esfuerzo y por el plazo del precio, no por el número de versión. La fuente primaria no informa fecha de fin de soporte.
- Trate los benchmarks como tesis por validar. DeepSWE v1.1, CyberGym y CWE-Bench son números del fabricante en el anuncio del 02/09/2026. El piloto con la carga real de la empresa es lo que convierte tablero en decisión.
Preguntas frecuentes sobre el Gemini 3.8 Flash
¿Cuánto cuesta el Gemini 3.8 Flash? US$ 0,75 por millón de tokens de entrada y US$ 3,75 por millón de tokens de salida, el mismo precio introductorio del 3.7 Flash, según el anuncio del 02/09/2026. La nota al pie oficial fija el plazo: el precio expira el 31/12/2026 y, a partir del 01/01/2027, valen US$ 1,50 y US$ 7,50.
¿Qué es el Gemini 3.8 Flash Cyber? Es la variante de ciberseguridad del 3.8 Flash, con desempeño de frontera en descubrimiento autónomo de vulnerabilidades y parcheo automatizado. El anuncio cita 47,2% de pass@1 en el CWE-Bench, frente a 47,8% de un modelo de frontera líder, a un costo significativamente menor, y una tasa de éxito superior al 70% en el benchmark interno de 20 lenguajes.
¿El Gemini 3.8 Flash Cyber está disponible para cualquier empresa? No. En el momento de la publicación (10/09/2026), el acceso es exclusivo del programa Fairwind, destinado a autoridades gubernamentales confiables, operadores de infraestructura crítica y mantenedores de software. La fuente primaria no informa criterios de expansión ni fecha para un acceso más amplio.
¿El 3.7 Flash sigue disponible? Sí. Según el anuncio del 02/09/2026, el 3.7 Flash sigue soportado para cargas efficiency-first. Google no informó fecha de fin de soporte en el material citado en esta pieza.
¿Qué cambia en el precio en 2027? Se duplica. A partir del 01/01/2027, el Gemini 3.8 Flash cuesta US$ 1,50 por millón de tokens de entrada y US$ 7,50 de salida, el doble del nivel introductorio, conforme la nota al pie del anuncio del 02/09/2026.
Referencias y lecturas complementarias
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber, Tulsee Doshi y Raluca Ada Popa, The Keyword (Google), 02/09/2026
- Gemini 3.8 Flash Cyber, página del modelo, Google DeepMind
- Fairwind program, página oficial del programa
- Fairwind program, post oficial en el blog de Google
- Explicador de gateway y router de IA
- Gateway corporativo: enrutamiento y seguridad
- Costo de modelos de IA como argumento de enrutamiento
- Análisis del video agéntico en Gemini
Qué observar
El calendario manda. El precio introductorio expira el 31/12/2026, la tarifa duplicada vale a partir del 01/01/2027 y entre las dos fechas queda la decisión de qué ruta ocupa el Gemini 3.8 Flash en el mix. La ausencia que sigue sin respuesta es la de Fairwind: ningún plazo y ningún criterio de expansión en el momento de la publicación.
Dos señales valen seguimiento. La primera es la cadencia de la línea Flash: tres lanzamientos en seis semanas indican que la ventana de evaluación de un modelo Flash es menor que el ciclo trimestral de revisión de muchas empresas, y la próxima generación va a reabrir la hoja de cálculo otra vez. La segunda es la validación independiente de los benchmarks del anuncio; mientras no llegue, los números de Google valen como tesis.
Para quien enruta modelos, el lanzamiento cambia tres variables de la decisión, y ninguna de ellas es qué modelo es mejor. El precio tiene horizonte con fecha. El costo por tarea tiene dial. La ruta de seguridad tiene puerta, y quien guarda la llave es Fairwind. Una política de tarifas con plazo, una configuración de esfuerzo y una regla de acceso son exactamente el tipo de parámetro que una capa de enrutamiento convierte en decisión automática, y es en esa capa donde opera el Nexforce Router. El acceso restringido de la Cyber y el precio que se duplica en enero no son cambios de catálogo; son cambios de política, y la política es lo que queda bajo control de quien enruta.

Acelera la eficienciaoperativa de tu negocio
Diseñamos tecnología de nivel global para impulsar escala del negocio
Hablar con un EspecialistaArtículos relacionados

GPT-6 Astra: precio, benchmarks y seguridad de OpenAI
OpenAI lanzó el GPT-6 Astra a US$ 10/US$ 50 por millón de tokens, con calificación Critical en ciberseguridad y monitorabilidad peor que la de su antecesor. La pieza muestra qué cambia esa combinación en la decisión de enrutamiento de quien consume la API en producción.
Read more
ChatGPT Ads alcanza US$ 1.000M de run rate y abre autoservicio global
OpenAI alcanza el hito de US$ 1.000 millones en ingresos anualizados por publicidad en ChatGPT en 200 días y habilita la compra global de anuncios en autoservicio.
Read more
Quasar 438B: el modelo europeo de 438B entra en el marcador de enrutamiento
Multiverse Computing lanzó el Quasar 438B, un modelo de razonamiento de clase 438B en inglés y español que marca 43 en el Intelligence Index v4.1.1 y responde 500 tokens con thinking en 15,3 segundos. Para quien enruta modelos, Europa gana una ruta de razonamiento con latencia de flash y contexto largo cerca de la frontera.
Read more