Google tiró Gemini 3.8 Flash — el tercer modelo flash en seis semanas
Google acaba de soltar Gemini 3.8 Flash, la tercera variante flash en seis semanas. La línea flash es su modelo liviano, barato y rápido — el que usás a escala cuando no podés pagar los modelos pesados. Está hecho para tareas de alto volumen: enrutar tickets de soporte, parsear formularios, resumir documentos. No para escribir ensayos ni codear el próximo modelo de frontera.
Los modelos flash son los caballos de batalla. Intercambian calidad por velocidad y costo, y son los que realmente mueven tráfico en producción. Seis semanas entre releases es rápido — no estás recibiendo mejoras incrementales, sino una línea rolling de modelos optimizados para distintos trade-offs de costo y rendimiento. Si estás corriendo inference a volumen, esto mantiene la factura manejable.
Por qué nos importa: los modelos flash mantienen el costo de correr workloads de IA bajo, así que equipos chicos, nonprofits y negocios de barrio pueden usarlos sin quemarse la tarjeta de crédito.