Google Lanza Gemini 3.7 Flash Solo Tres Semanas Después de 3.6, Mientras Gemini 3.5 Pro Sigue Retrasado
Gemini 3.7 Flash obtiene 65.3% en DeepSWE v1.1, frente al 49.0% del modelo anterior, y llega a la mitad del precio de lanzamiento. Es el ciclo Flash-a-Flash más rápido que Google ha entregado.
Google lanzó Gemini 3.7 Flash el 13 de agosto — tres semanas después de Gemini 3.6 Flash, y sin entrenar un modelo nuevo desde cero. El equipo, en cambio, agregó mejoras algorítmicas y comentarios de usuarios sobre la base de 3.6, y las cifras de codificación se movieron: 65.3% en DeepSWE v1.1, frente al 49.0% de Gemini 3.6 Flash, un salto de 16 puntos en un solo ciclo de iteración.
El modelo se presenta como un “caballo de batalla” para codificación, desarrollo web y flujos de trabajo con agentes, no como una apuesta de razonamiento de frontera — ese papel sigue siendo de Gemini 3.5 Pro, que permanece retrasado sin fecha de lanzamiento confirmada. Google dice que 3.7 Flash es más fiable generando código desplegable y listo para producción en el primer intento, el fallo específico que obliga a los desarrolladores a recurrir a modelos más lentos y caros a mitad de tarea.
El precio bajó junto con la mejora de capacidad: $0.75 por millón de tokens de entrada y $3.75 por millón de salida, la mitad de lo que costaba 3.6 Flash al lanzarse. Es un posicionamiento agresivo en un campo donde todos los laboratorios grandes han recortado precios este verano — OpenAI llevó GPT-5.6 Luna a $0.20/$1.20, DeepSeek lanzó V4-Flash a $0.14/$0.28, y Grok 4.6 de xAI queda por debajo tanto de Claude Opus como de GPT-5.6 a $2/$6. Los modelos de nivel Flash se están convirtiendo en una categoría de producto básico donde el factor decisivo es la fiabilidad de codificación por dólar, no la posición bruta en benchmarks.
La disponibilidad es amplia desde el primer día: la API de Gemini en Google AI Studio, Android Studio, Google Antigravity para flujos de trabajo centrados en agentes, y en toda la Gemini Enterprise Agent Platform y la app de consumo. Es el mismo patrón de despliegue simultáneo que Google usó para 3.6 Flash, y señala que la empresa está tratando los lanzamientos de nivel Flash como actualizaciones de infraestructura, no como lanzamientos de producto estelares — lanzar rápido, lanzar en todas partes, iterar de nuevo en semanas en lugar de trimestres.
El ritmo de tres semanas es la verdadera noticia aquí. Los laboratorios de frontera solían lanzar actualizaciones de modelos importantes con un ritmo aproximadamente trimestral. Que Google haya comprimido el ciclo Flash-a-Flash a tres semanas — sin un reentrenamiento completo — sugiere que el costo marginal de una iteración de capacidad ha bajado lo suficiente como para que “lánzalo ahora, corrígelo en un mes” sea viable incluso en modelos usados en canalizaciones de codificación en producción. Si el retraso de Gemini 3.5 Pro se alarga más, Flash seguirá absorbiendo mejoras de capacidad que antes habrían esperado al lanzamiento de nivel Pro.
Para los equipos que ya usan Gemini 3.6 Flash, actualizar no cuesta más que un cambio de versión y debería ser automático — mejores benchmarks, precio más bajo, misma superficie de API. Para quien compare modelos de nivel flash desde cero, el 65.3% en DeepSWE v1.1 marca ahora la vara que el resto del campo debe igualar.
Fuentes
Lecturas relacionadas
- Modelos de IA Gemini 3.5 Pro de Google llega en junio — contexto de 2 millones de tokens y razonamiento Deep Think
- Modelos de IA Google I/O 2026 comienza mañana: nuevo modelo Gemini, generación de video con Omni y Project Astra en escena
- Modelos de IA Google lanza Gemini 3.6 Flash, 3.5 Flash-Lite y un modelo de ciberseguridad — sigue sin haber 3.5 Pro