Google ha lanzado Gemini 3.7 Flash apenas tres semanas después de Gemini 3.6 Flash, con una combinación poco habitual en una actualización tan rápida: mejoras relevantes en programación y agentes y una reducción temporal del precio de la API. El modelo, disponible desde el 13 de agosto, se sitúa como la nueva pieza de volumen de la familia Gemini para empresas que necesitan ejecutar tareas largas, usar herramientas y procesar documentos sin recurrir siempre a los modelos más caros. La cuestión operativa queda en el coste total de esos flujos cuando entran en producción y empiezan a acumular llamadas, reintentos y supervisión humana.
Gemini 3.7 Flash acelera en código y agentes
La principal mejora aparece en ingeniería de software. En FrontierCode 1.1 Main, una evaluación orientada a calidad de código de producción, Gemini 3.7 Flash alcanza un 43,6%, frente al 34,4% de Gemini 3.6 Flash. En DeepSWE v1.1, centrado en tareas de ingeniería de software de horizonte largo, sube al 65,3% desde el 48,6% registrado por su predecesor en la ficha técnica de Google DeepMind.
El salto importa porque los agentes de programación pueden acumular costes fuera del primer intento. Un error de interpretación puede desencadenar cambios innecesarios, nuevas llamadas a herramientas o revisiones humanas. Google sostiene que 3.7 Flash gestiona mejor los bloqueos, sigue instrucciones con mayor fidelidad y dedica más esfuerzo a la planificación de varios pasos. La compañía vincula ese comportamiento con menos reintentos y menor supervisión, una afirmación que todavía tendrá que contrastarse con cargas reales y repositorios propios de cada empresa.
Los resultados comparativos tampoco dibujan un liderazgo uniforme. En DeepSWE v1.1, GPT-5.6 Terra figura por delante con un 69,6%, y en Terminal-bench 2.1 alcanza un 87,4%, frente al 85,8% de Gemini 3.7 Flash. El modelo de Google, sin embargo, supera en FrontierCode 1.1 Main las cifras que su propia tabla atribuye a Claude Sonnet 5 y GPT-5.6 Terra. Son resultados publicados por Google y dependen de metodología, configuración y versión de cada sistema, por lo que sirven mejor como señal de evolución que como sustituto de una prueba interna.
Gemini 3.7 Flash mejora el trabajo con documentos
El avance se extiende a tareas menos visibles que la generación de código. En GDP.pdf, una evaluación de comprensión de documentos complejos, Gemini 3.7 Flash obtiene un 34%, frente al 22% de 3.6 Flash. En AutomationBench, orientado a automatización de flujos empresariales, pasa del 17% al 30,4%. La ficha de Google sitúa además al nuevo Flash por encima de los modelos comparados en esa prueba concreta.
Para departamentos jurídicos, financieros o de operaciones, ese tipo de evaluación se aproxima al patrón de uso de numerosos agentes corporativos: leer un informe, localizar una cifra, decidir qué herramienta utilizar, actualizar otro sistema y devolver un resultado revisable. El valor depende de que la cadena completa conserve precisión. Un porcentaje mejor en comprensión documental pierde efecto si la acción posterior se ejecuta sobre el archivo equivocado o con permisos incorrectos.
La arquitectura de acceso mantiene una ventana de contexto de hasta un millón de tokens y una salida máxima de 64.000 tokens. El modelo acepta texto, imágenes, audio y vídeo, y permite ajustar el nivel de razonamiento para equilibrar calidad, coste y latencia. Esa continuidad con 3.6 Flash facilita la migración conceptual para equipos que ya trabajan con la gama, aunque cada integración deberá revisar comportamiento, consumo y límites antes de sustituir un modelo en producción.
También hay un cambio en desarrollo web. Google reporta un Elo de 1.588 en Code Arena, frente a 1.538 de 3.6 Flash, y afirma que el modelo sigue con más precisión referencias visuales como capturas, imágenes o sistemas de diseño. La mejora apunta a un uso más amplio de agentes capaces de producir interfaces completas, aunque los resultados visuales y funcionales siguen requiriendo validación sobre accesibilidad, rendimiento, seguridad y compatibilidad.
El precio de Gemini 3.7 Flash cambia la comparación
Hasta el 31 de diciembre de 2026, la API estándar cuesta 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de tokens de salida, incluidos los tokens de razonamiento. Google presenta esa tarifa como la mitad del precio original de Gemini 3.6 Flash. A partir del 1 de enero de 2027, las tarifas estándar subirán a 1,50 y 7,50 dólares, respectivamente. Batch y Flex tienen durante el periodo introductorio precios de 0,375 dólares para entrada y 1,875 para salida.
Ese calendario convierte los próximos meses en una ventana de prueba especialmente atractiva para proyectos con mucho volumen. También introduce una variable que conviene separar del rendimiento técnico. Un agente barato por token puede resultar costoso si necesita demasiadas iteraciones, consume respuestas largas o genera incidencias que acaban en revisión manual. Para una empresa, la comparación relevante incorpora el coste por tarea completada, junto con latencia, tasa de éxito y horas de intervención humana.
Google está llevando Gemini 3.7 Flash a Gemini Spark, su agente para suscriptores de Google AI Pro y Ultra, disponible en más de 160 países. Spark puede trabajar con aplicaciones de Google Workspace para consolidar archivos, redactar correos y actualizar documentos de estado. Para empresas, el modelo también se ofrece mediante Gemini Enterprise Agent Platform y la aplicación Gemini Enterprise, además de Gemini API, AI Studio y Google Antigravity.
La expansión llega mientras la hoja de ruta de los modelos Pro permanece menos clara. Reuters señaló que Google todavía no ha dado una fecha para Gemini 3.5 Pro, que en julio seguía en pruebas con socios, y Axios apuntó que la compañía ya ha hablado de avances iniciales en Gemini 4. La secuencia sitúa a Flash en un papel cada vez más central para la comercialización inmediata de agentes, mientras la gama de mayor capacidad continúa pendiente de una nueva referencia pública.
El lanzamiento coincide además con una reorganización reciente en Google DeepMind. Reuters informó esta semana de que Demis Hassabis ha pasado a la presidencia de la unidad y Koray Kavukcuoglu ha asumido su dirección, dentro de un reajuste ligado a la presión por acelerar Gemini y su explotación comercial. Ese marco corporativo añade otra lectura al intervalo de tres semanas entre 3.6 y 3.7 Flash: Google está acortando los ciclos de iteración precisamente en las áreas donde programación y agentes concentran buena parte de la competencia entre proveedores.
Para los responsables tecnológicos, la decisión inmediata se juega fuera de los gráficos de benchmark. La tarifa rebajada permite probar 3.7 Flash con un coste de inferencia menor durante 2026, pero el precio se duplica en enero. Las implantaciones que se diseñen alrededor de esta ventana necesitarán medir desde el principio cuántos pasos completa el modelo correctamente, qué tareas siguen requiriendo supervisión y cuánto cuesta una operación terminada cuando el descuento desaparezca.
