Google presentó Gemini 3.7 Flash, un modelo orientado a programación, agentes de IA y flujos de trabajo complejos. Llega apenas tres semanas después de Gemini 3.6 Flash, pero con mejoras importantes en generación de código, desarrollo web, análisis documental y automatización empresarial.
Lo más llamativo es que Google también reduce el precio introductorio: hasta finales de año, Gemini 3.7 Flash costará 0,75 dólares por cada millón de tokens de entrada y 3,75 dólares por cada millón de tokens de salida. ¿Qué significa esto en la práctica? Que los equipos pueden ejecutar agentes más capaces sin que cada tarea implique un aumento considerable de costos.
Más precisión para programar y resolver problemas
Gemini 3.7 Flash mejora frente a la versión 3.6 en tareas como depuración, resolución de incidencias y generación de código listo para producción. Google afirma que el modelo logra una mayor precisión desde el primer intento, algo especialmente valioso cuando una herramienta debe actuar con poca supervisión humana.
En las evaluaciones citadas por la compañía, obtuvo los siguientes resultados:
- FrontierCode 1.1 Main: 43,6% frente a 34,4% de Gemini 3.6 Flash.
- DeepSWE v1.1: 65,3% frente a 49,0% de Gemini 3.6 Flash.
Estos números no significan que el modelo pueda reemplazar automáticamente a un equipo de ingeniería. Sí indican que puede reducir el número de correcciones, reintentos y revisiones necesarias en tareas de desarrollo bien definidas.
Desarrollo web con menos instrucciones
La nueva versión también apunta a crear interfaces más funcionales y aplicaciones con más características usando menos prompts. En la generación de interfaces, Google destaca una mejor capacidad para respetar un diseño de referencia, ya sea una captura de pantalla, una imagen o un sistema completo de diseño.
En WebDev Arena, una evaluación de Arena.ai para comparar modelos en desarrollo web, Gemini 3.7 Flash alcanzó una puntuación Elo de 1588, por encima de los 1538 puntos de Gemini 3.6 Flash.
Para un desarrollador o emprendedor, la diferencia puede sentirse en tareas concretas: convertir un boceto en una interfaz navegable, mantener los colores y espaciados de una marca, o generar una primera versión funcional de un panel administrativo sin tener que describir cada detalle varias veces.
Mejor rendimiento en documentos y automatización
Gemini 3.7 Flash también mejora en áreas con alta densidad de conocimiento, como finanzas, derecho y biociencias. En el benchmark GDP.pdf, diseñado para evaluar la comprensión de documentos complejos, obtuvo 34,0%, frente al 22,0% de Gemini 3.6 Flash.
En AutomationBench, una evaluación centrada en flujos de trabajo empresariales reales, consiguió 30,4%, frente al 17,0% de la versión anterior. La cifra sugiere una mayor capacidad para completar procesos con varios pasos, aunque cualquier uso en ámbitos regulados todavía requiere validación profesional.
Un modelo más capaz no elimina la necesidad de revisión. La ventaja está en que puede avanzar más antes de necesitar intervención humana.
Agentes con mejor planificación y menos supervisión
Google describe Gemini 3.7 Flash como un modelo que se adapta mejor cuando encuentra obstáculos, pide aclaraciones cuando la intención no está clara y sigue las instrucciones con mayor fidelidad.
También dedica más esfuerzo a la planificación de varios pasos y al uso de herramientas. En un agente de IA, esto es fundamental: no basta con responder una pregunta, también debe decidir qué acción ejecutar, en qué orden y cómo verificar el resultado.
Por ejemplo, un agente podría reunir información de varios archivos, redactar un correo y actualizar un documento de estado. Si interpreta mal una instrucción en cualquiera de esos pasos, el resultado final pierde valor. La promesa de Gemini 3.7 Flash es reducir esos errores y la cantidad de reintentos necesarios.
Gemini Spark recibe la actualización
Gemini Spark comenzará a utilizar Gemini 3.7 Flash desde hoy. Este agente personal de Google está disponible para suscriptores de Google AI Pro y Ultra en más de 160 países, según la compañía.
Spark puede trabajar con aplicaciones de Google Workspace y ayudar a convertir ideas en acciones. Entre los ejemplos mencionados están consolidar archivos, redactar correos y actualizar documentos de seguimiento.
Con el nuevo modelo, Google espera mejorar la precisión y la calidad de resultados en tareas que combinan varias habilidades. La diferencia será especialmente relevante cuando el usuario no busca una respuesta aislada, sino completar un proceso de principio a fin.
Seguridad para usos sensibles
Gemini 3.7 Flash incorpora actualizaciones en las medidas de seguridad frente a usos indebidos relacionados con riesgos químicos, biológicos, radiológicos y nucleares, además de ciberataques.
Google señala que estas protecciones buscan limitar usos dañinos sin bloquear aplicaciones beneficiosas. Los detalles técnicos adicionales están disponibles en la tarjeta del modelo, conocida como model card, donde se documentan capacidades, riesgos y evaluaciones de seguridad.
Dónde probar Gemini 3.7 Flash
- Desarrolladores: pueden explorar flujos de trabajo centrados en agentes mediante Google Antigravity o comenzar con la API de Gemini en Google AI Studio y Android Studio.
- Empresas: pueden acceder al modelo desde Gemini Enterprise Agent Platform y la aplicación Gemini Enterprise.
- Usuarios individuales: pueden utilizarlo mediante Spark en la aplicación Gemini, siempre que tengan un plan Google AI Pro o Ultra en un país compatible.
La llegada de Gemini 3.7 Flash muestra hacia dónde compite la industria: modelos que no solo generan texto o código, sino que planifican, usan herramientas y completan tareas con menor supervisión. La clave no estará únicamente en la potencia del modelo, sino en cuánto tiempo y dinero puede ahorrar cuando se integra de forma responsable en un flujo de trabajo real.
Fuente original
https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash
