DEV Community

Cover image for ¿Qué hay de nuevo en Gemini 3.7 Flash? Características, Benchmarks y Acceso a la API
Roobia
Roobia

Posted on • Originally published at apidog.com

¿Qué hay de nuevo en Gemini 3.7 Flash? Características, Benchmarks y Acceso a la API

Gemini 3.7 Flash es el modelo de IA de uso general más reciente de Google, lanzado el 13 de agosto de 2026, tres semanas después de Gemini 3.6 Flash. Mantiene una ventana de contexto de 1M de tokens y entrada multimodal, pero mejora de forma notable en benchmarks de codificación y agentes. Su precio introductorio para la API es de $0.75 por 1M de tokens de entrada.

Prueba Apidog hoy

La cadencia de lanzamiento importa: mientras Gemini 3.5 Pro sigue retrasado, Google está entregando mejoras primero en Flash. DeepSWE sube 16.3 puntos, AutomationBench pasa de 17.0% a 30.4% y el precio inicial es la mitad del precio de lanzamiento de Gemini 3.6 Flash.

En este artículo verás qué cambió, cómo estimar costos, dónde usar el modelo y cómo hacer una primera llamada con curl. Para profundizar en el endpoint, consulta el inicio rápido de la API de Gemini 3.7 Flash. También puedes usar Apidog para comparar respuestas con tus prompts actuales antes de migrar.

En resumen

  • Gemini 3.7 Flash se lanzó el 13 de agosto de 2026. ID del modelo: gemini-3.7-flash.
  • DeepSWE v1.1 sube de 49.0% a 65.3%; AutomationBench, de 17.0% a 30.4%; WebDev Arena, de 1538 a 1588 Elo.
  • El precio introductorio es de $0.75 por 1M de tokens de entrada y $3.75 por 1M de tokens de salida.
  • Las tarifas estándar, $1.50 / $7.50, entran en vigor el 1 de enero de 2027.
  • Conserva contexto de 1M de tokens, salida de hasta 64k tokens, entrada multimodal, llamada a funciones, búsqueda como herramienta y uso de computadora.
  • Está disponible en la API de Gemini, AI Studio, Gemini, Gemini Spark, Google Antigravity, Android Studio y Gemini Enterprise, en más de 160 países.

Qué es Gemini 3.7 Flash

Flash es el nivel medio de Gemini: más económico y rápido que Pro, y más capaz que Flash-Lite para cargas de trabajo de alto volumen. Gemini 3.7 Flash es el tercer lanzamiento Flash de la línea 3.x.

El anuncio oficial lo posiciona principalmente para codificación y agentes, no solo para chat.

Gemini 3.7 Flash

La especificación base se mantiene respecto a Gemini 3.6 Flash:

  • Contexto: 1M de tokens de entrada y hasta 64k tokens de salida.
  • Entrada multimodal: texto, imagen, video, audio y PDF.
  • Salida: texto.
  • Herramientas: llamada a funciones, búsqueda como herramienta y uso de computadora.
  • Seguridad: incluye salvaguardas CBRN y cibernéticas actualizadas.

El cambio está en el comportamiento. Google afirma mejores resultados al depurar, generar código desplegable, adaptarse a fallos de herramientas, pedir aclaraciones y seguir restricciones de formato.

Mejoras en benchmarks: Gemini 3.6 vs. 3.7 Flash

Benchmark Gemini 3.6 Flash Gemini 3.7 Flash Cambio
DeepSWE v1.1 (codificación agéntica) 49.0% 65.3% +16.3 pts
FrontierCode 1.1 Main 34.4% 43.6% +9.2 pts
WebDev Arena (Elo) 1538 1588 +50 Elo
GDP.pdf (razonamiento documental) 22.0% 34.0% +12.0 pts
AutomationBench (tareas de agente) 17.0% 30.4% +13.4 pts

También obtiene:

  • 90.7% en Harvey LAB-AA, un benchmark de razonamiento legal.
  • 97.0% en recuperación de contexto largo 128k-needle.

Los mayores incrementos aparecen en tareas de varios pasos. Esto es especialmente relevante si ejecutas agentes que deben inspeccionar archivos, usar herramientas, corregir errores o recuperar información desde documentos extensos.

La cobertura del lanzamiento destaca DeepSWE como el salto principal. Para comparar cómo estas diferencias de benchmarks se trasladan a cargas de trabajo reales entre modelos, consulta esta comparación de Grok 4.6 vs GPT 5.6 vs Claude.

Qué probar en codificación y agentes

No migres solo por un benchmark. Ejecuta pruebas con tareas representativas de tu aplicación.

Prioriza estos casos:

  1. Depuración multiarchivo

    Pasa un error, el stack trace y los archivos implicados. Evalúa si el modelo identifica la causa raíz en vez de proponer un parche superficial.

  2. Generación de código ejecutable

    Pide una función con tests, validación de entradas y manejo de errores. Verifica si pasa CI sin una segunda iteración.

  3. Recuperación ante fallos de herramientas

    Simula respuestas fallidas de una función o una API. Comprueba si el agente reintenta con parámetros distintos, solicita contexto o entra en bucle.

  4. Seguimiento de restricciones

    Añade límites explícitos: formato JSON, longitud máxima, dependencias permitidas y operaciones prohibidas.

  5. Prompts ambiguos

    Evalúa si pregunta antes de asumir requisitos críticos.

Las capacidades de llamada a funciones, búsqueda como herramienta y uso de computadora se mantienen desde Gemini 3.6 Flash. Para flujos automatizados, prioriza APIs estructuradas cuando existan: son más rápidas y deterministas que controlar un navegador. El análisis de uso de computadora frente a APIs estructuradas explica cuándo usar cada enfoque.

Precios: tarifa introductoria hasta el 31 de diciembre de 2026

Período Entrada por 1M de tokens Salida por 1M de tokens
Hasta el 31 de diciembre de 2026 $0.75 $3.75
Desde el 1 de enero de 2027 $1.50 $7.50

La tarifa introductoria reduce a la mitad el precio de lanzamiento de Gemini 3.6 Flash. Sin embargo, el costo se duplica el 1 de enero de 2027.

Recomendación para presupuestar

Usa la tarifa estándar para proyectar costos a largo plazo:

costo_entrada = tokens_entrada / 1_000_000 * 1.50
costo_salida  = tokens_salida / 1_000_000 * 7.50
costo_total   = costo_entrada + costo_salida
Enter fullscreen mode Exit fullscreen mode

Verifica siempre las tarifas actuales en la página oficial de precios antes de desplegar. Para ejemplos de cálculo en chatbots, pipelines de documentos y agentes, consulta el análisis de precios de Gemini 3.7 Flash.

Dónde puedes usarlo hoy

Gemini 3.7 Flash está disponible en más de 160 países mediante:

  • API de Gemini: usa una clave de AI Studio y el modelo gemini-3.7-flash.
  • Google AI Studio: prueba prompts desde el navegador.
  • Aplicación Gemini: interfaz de chat para consumidores.
  • Gemini Spark: para suscriptores de AI Pro y Ultra.
  • Google Antigravity: entorno de desarrollo agéntico.
  • Android Studio: asistencia de código integrada.
  • Gemini Enterprise: opción gestionada para organizaciones.

Para cargas empresariales, Vertex AI usa aiplatform.googleapis.com con OAuth, IAM y registro de auditoría. El modelo y el esquema de solicitud son los mismos; cambian la autenticación y las garantías operativas.

Por qué Google lanzó Flash antes que Gemini 3.5 Pro

El orden es inusual: Gemini 3.6 Flash llegó a finales de julio, Gemini 3.7 Flash tres semanas después y Gemini 3.5 Pro sigue sin fecha.

Según Axios, Google está lanzando deliberadamente actualizaciones de Flash antes de su próximo modelo insignia. Para equipos de producto, esto cambia la prioridad de evaluación: Flash ya no debe considerarse automáticamente la opción rezagada frente a Pro.

Si actualmente usas Gemini 3.6 Flash, la migración normalmente comienza con un cambio de ID de modelo y una pasada de regresión:

- gemini-3.6-flash
+ gemini-3.7-flash
Enter fullscreen mode Exit fullscreen mode

La guía de migración de Gemini 3.6 a 3.7 Flash detalla el proceso.

Cómo probar la API en cinco minutos

Primero, crea una clave en Google AI Studio.

Después, expórtala como variable de entorno:

export GEMINI_API_KEY="AIza..."
Enter fullscreen mode Exit fullscreen mode

Envía una solicitud a generateContent:

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{
      "parts": [{
        "text": "Review this function for bugs: def dedupe(items): return list(set(items))"
      }]
    }],
    "generationConfig": {
      "temperature": 0.4,
      "maxOutputTokens": 1024
    }
  }'
Enter fullscreen mode Exit fullscreen mode

La respuesta incluye:

  • candidates: respuestas generadas.
  • content.parts: texto de la respuesta.
  • usageMetadata: número de tokens de entrada y salida.

Registra usageMetadata desde el inicio. Es la fuente de datos para medir costos reales y detectar prompts que consumen más tokens de lo previsto.

Para recibir resultados en streaming, reemplaza el endpoint:

:generateContent
Enter fullscreen mode Exit fullscreen mode

por:

:streamGenerateContent?alt=sse
Enter fullscreen mode Exit fullscreen mode

La API devolverá eventos SSE.

Comparar Gemini 3.6 Flash y 3.7 Flash

Una forma práctica de validar la migración es ejecutar exactamente los mismos prompts contra ambos modelos.

En Apidog:

  1. Importa la especificación de la API de Gemini.
  2. Guarda GEMINI_API_KEY como variable de entorno.
  3. Usa una variable para el ID del modelo.
  4. Ejecuta la misma colección con gemini-3.6-flash y gemini-3.7-flash.
  5. Compara salida, latencia y usageMetadata.
  6. Guarda respuestas esperadas como ejemplos para futuras pruebas de regresión.

Esto permite validar el seguimiento de instrucciones con tus propios prompts, en lugar de depender únicamente de benchmarks públicos.

Preguntas frecuentes

¿Es Gemini 3.7 Flash de uso gratuito?

La API de Gemini incluye un nivel gratuito a través de AI Studio con cuota diaria para prototipos. El uso de pago parte de $0.75 por 1M de tokens de entrada hasta el 31 de diciembre de 2026.

La guía de acceso gratuito a la API de Gemini cubre los límites y cómo trabajar dentro de ellos.

¿Cuál es la diferencia entre Gemini 3.6 Flash y 3.7 Flash?

Las especificaciones principales no cambian: mismo contexto, límite de salida, modalidades y herramientas. La diferencia está en el rendimiento:

  • DeepSWE: +16.3 puntos.
  • AutomationBench: +13.4 puntos.
  • WebDev Arena: +50 Elo.
  • Mejor depuración, seguimiento de instrucciones y planificación de varios pasos, según Google.

¿Gemini 3.7 Flash reemplaza a Gemini 3.5 Pro?

No. Pro sigue siendo el nivel insignia para las tareas de razonamiento más complejas. Gemini 3.7 Flash está orientado a producción de alto volumen, donde costo, latencia y calidad deben equilibrarse.

¿Qué ocurre con los precios el 1 de enero de 2027?

Finaliza la tarifa introductoria. Los precios pasan a $1.50 por 1M de tokens de entrada y $7.50 por 1M de tokens de salida.

¿Puede Gemini 3.7 Flash procesar imágenes y PDFs?

Sí. Admite texto, imágenes, video, audio y PDF en el array contents. La salida es texto. Google reporta una mejora en GDP.pdf, de 22.0% a 34.0%, para razonamiento documental.

Dónde encaja Gemini 3.7 Flash en tu pila

Gemini 3.7 Flash combina benchmarks de agentes más altos con compatibilidad práctica con Gemini 3.6 Flash y una tarifa introductoria reducida.

La ruta recomendada es simple:

  1. Ejecuta tu suite de prompts contra gemini-3.7-flash.
  2. Compara calidad, latencia y uso de tokens con tu modelo actual.
  3. Prueba flujos de herramientas, recuperación ante fallos y tareas multiarchivo.
  4. Proyecta costos usando la tarifa estándar de 2027.
  5. Migra solo los casos donde la mejora sea medible.

Puedes descargar Apidog para centralizar esta comparación: guarda respuestas de Gemini 3.6 Flash como ejemplos, reproduce las mismas solicitudes con Gemini 3.7 Flash y valida los resultados con tu carga de trabajo real.

Top comments (0)