Google publicó Gemini 3.8 Flash el 2 de septiembre de 2026 — su tercer lanzamiento de la familia Flash en seis semanas — y lo presenta como "su modelo Flash más inteligente" hasta la fecha. Mejora a su predecesor directo, 3.7 Flash, en todos los benchmarks publicados: DeepSWE v1.1 sube de 65,3% a 73,7%, OSWorld-2.0 pasa de 50,6% a 59,0%, y marca 89,4% en Terminal-Bench 2.1 y 54,9% en HLE-Verified.
El precio de catálogo no sube: 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de salida, vigente hasta el 31 de diciembre de 2026 (después pasa a 1,50 $/7,50 $).
Pero el coste real por tarea sí sube — alrededor de un 40% más que 3.7 Flash según Artificial Analysis, porque el modelo genera de media un 30% más de tokens de salida por tarea y necesita más turnos en las evaluaciones agénticas.Dicho de otro modo: el precio por token es el mismo, pero hacen falta más tokens para completar el mismo trabajo. Para quien usa Flash en un flujo con volumen — automatizaciones, agentes que iteran sobre una tarea — el ahorro de la etiqueta de precio no se traduce directamente en una factura menor.
Google lanzó en paralelo Gemini 3.8 Flash Cyber, una variante especializada en parcheo de vulnerabilidades: 47,2% en CWE-Bench, casi a la par de un modelo de frontera líder (47,8%) pero a un coste mucho menor. Resulta interesante para quien quiera meter triage automatizado de código vulnerable en un pipeline propio, aunque sigue siendo un servicio en la nube de Google, no algo que se pueda autoalojar.
Para un homelab que ya usa la API de Gemini Flash en n8n o en un agente propio, la actualización merece la pena por la mejora real en benchmarks de código y de uso de herramientas — pero conviene medir el gasto real de las primeras semanas en vez de fiarse solo de que el precio por token no haya cambiado.
Fuentes: blog.google · computingforgeeks.com



