Cómo usar Gemini 3.8 Flash gratis: guía práctica con API
Gemini 3.8 Flash se lanzó el 2 de septiembre de 2026. A diferencia de muchos lanzamientos pioneros de este año, ofrece un camino gratuito real: puedes probarlo sin costo en Google AI Studio y llamarlo desde el nivel gratuito de la API de Gemini con una clave que se crea en aproximadamente un minuto. Google lo presenta como “nuestro modelo Flash más inteligente” y el nivel gratuito utiliza el mismo ID gemini-3.8-flash que los clientes de pago, no una variante reducida.
Hay tres advertencias importantes:
- El nivel gratuito tiene límites de tasa.
- Google utiliza los datos del nivel gratuito para mejorar sus productos.
- La aplicación Gemini no incluye 3.8 Flash en su plan gratuito; necesitas Google AI Pro o Ultra.
Para conocer las especificaciones completas, consulta qué es Gemini 3.8 Flash. Si quieres ejecutar una solicitud ahora, sigue estos pasos.
Acceso gratuito de un vistazo
| Superficie | Costo | ¿Gemini 3.8 Flash incluido? | Advertencia |
|---|---|---|---|
| Google AI Studio | $0 | Sí | Límites de tasa; los datos se utilizan para mejorar productos |
| Nivel gratuito de la API de Gemini | $0 | Sí | Mismos límites publicados en AI Studio |
| Aplicación Gemini, plan gratuito | $0 | No | 3.8 Flash requiere Google AI Pro o Ultra |
| Modo IA en la Búsqueda de Google | $0 | Sí, para consumidores | Sin API ni control del nivel de pensamiento |
| Gemini en Hojas de cálculo de Google | Depende del plan | Sí, para consumidores | Sin API |
| Contextualización de Búsqueda de Google | 5.000 solicitudes/mes gratis | Compartida entre Gemini 3.x | Después, $14 por cada 1.000 solicitudes |
| API por lotes | 50 % de descuento sobre las tarifas de pago | Sí | No es gratuita, pero es la opción de pago más económica |
| Gemini 3.8 Flash Cyber | No se vende | No | Solo Programa Fairwind; no existe API pública |
Paso 1: selecciona gemini-3.8-flash en AI Studio
Abre Google AI Studio e inicia sesión. No necesitas una cuenta de facturación ni una tarjeta de crédito.
En el selector de modelos, elige gemini-3.8-flash. Es el ID estable, sin sufijo de vista previa. La configuración de ejecución ofrece tres niveles de pensamiento:
low-
medium, el valor predeterminado high
El modelo no admite un nivel mínimo. Si lo envías mediante la API, recibirás un error de validación en lugar de una alternativa silenciosa. Consulta la guía de niveles de pensamiento para comparar el costo en tokens y tiempo.
Para empezar:
- Mantén la temperatura en su valor predeterminado de
1.0. Google advierte que reducirla puede provocar bucles o respuestas degradadas. - Usa
lowmientras experimentas.
Gemini 3.8 Flash está diseñado para trabajar más en tareas complejas: puede tomar pasos de razonamiento más pequeños y llamar a herramientas de forma iterativa. Google también indica que puede consumir más tokens en tareas complejas y prolongadas. Como los límites se miden en tokens por minuto, ese consumo agota la cuota más rápido que en 3.7 Flash. low mantiene los experimentos económicos.
Paso 2: crea una clave API gratuita
En AI Studio, abre la página de claves API y crea una clave en un proyecto nuevo o existente. Es gratuita y funciona de inmediato con el nivel gratuito. La página de precios de Gemini muestra la entrada y salida de 3.8 Flash como “Gratuitas” en ese nivel.
Si es tu primera clave, consulta esta guía para crear una clave API de Gemini.
Guárdala como variable de entorno y no la incluyas en el código ni en el historial del shell:
export GEMINI_API_KEY="paste-your-key-here"
Trátala como una contraseña. Aunque una clave filtrada del nivel gratuito no puede generar una factura, sí puede consumir tu cuota diaria antes de que la utilices.
Paso 3: realiza tu primera solicitud
Gemini 3.x funciona principalmente con la API de Interactions. Puedes hacer una solicitud sin instalar un SDK:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-[REDACTED CREDENTIAL] \
-H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
La respuesta contiene una lista de pasos de ejecución —pensamientos del modelo y llamadas a herramientas, si las hubiera— que termina en un paso model_output con el texto generado.
Si tu código utiliza generateContent, todavía funciona. Google lo considera heredado, pero “totalmente compatible” y sin fecha de finalización anunciada. En ese endpoint, el nivel se configura mediante:
generationConfig.thinkingConfig.thinkingLevel
La guía de la API de Gemini 3.8 Flash incluye ambas formas, ejemplos en Python y conversaciones multi-turno con previous_interaction_id.
Si recibes un error 429, alcanzaste el límite de tasa del nivel gratuito. Espera o pasa al Nivel 1.
Qué cuesta realmente el nivel gratuito
En dólares: nada. En la práctica, pagas de otras tres formas.
1. Límites de tasa
El nivel gratuito limita, por modelo:
- Solicitudes por minuto.
- Tokens por minuto.
- Solicitudes por día.
Google publica las cifras exactas en la página de límites de tasa de AI Studio, no siempre en la documentación. Además, pueden cambiar sin una entrada en el registro de cambios. Consulta esa página para conocer los límites actuales de tu proyecto y revisa cómo se acumulan los niveles en el documento de límites de tasa.
2. Tus datos
Google afirma que las solicitudes y respuestas del nivel gratuito se utilizan para mejorar sus productos. Esto puede ser aceptable para una consulta de referencia o una aplicación de prueba, pero no para:
- Registros de clientes.
- Código fuente no publicado.
- Información protegida por un acuerdo de confidencialidad (NDA).
Los niveles de pago tienen condiciones diferentes. Si necesitas privacidad, vincula la facturación antes de enviar datos sensibles.
3. Consumo de tokens
Artificial Analysis midió 3.8 Flash en el nivel high con aproximadamente 48.000 tokens de salida por tarea, un 30 % más que 3.7 Flash. Los tokens de pensamiento cuentan para los mismos límites de tokens por minuto que la salida visible.
Por eso conviene usar low o medium hasta que necesites más margen.
La aplicación Gemini no es el camino gratuito
La aplicación Gemini ofrece 3.8 Flash a suscriptores de Google AI Pro y Ultra. El plan gratuito de la aplicación no lo incluye. Si ves un modelo Flash sin suscripción, no significa que sea 3.8 Flash.
Las superficies de consumo donde puedes usarlo sin un cargo adicional son:
- Modo IA en la Búsqueda de Google.
- Gemini en Hojas de cálculo de Google.
Ambas sirven para leer respuestas, pero no ofrecen control sobre el nivel de pensamiento, recuento de tokens ni API. Para desarrollo, AI Studio y el nivel gratuito de la API son las opciones adecuadas.
Contextualización gratuita: 5.000 búsquedas al mes
La contextualización de Búsqueda de Google permite incorporar resultados web actuales en la respuesta del modelo. Incluye 5.000 solicitudes gratuitas al mes compartidas entre todos los modelos Gemini 3.x.
Después, el precio es de $14 por cada 1.000 solicitudes. La cuota es mensual y compartida: las solicitudes contextualizadas de Gemini 3 Pro y Gemini 3.8 Flash consumen el mismo grupo de 5.000.
Es una asignación útil para prototipos con datos recientes, pero una función de producción necesita presupuesto propio.
Cuando se agota lo gratuito: opciones de pago
Un error 429 durante una demostración o alcanzar el límite diario indica que necesitas más capacidad. Estas son las opciones, de menor a mayor costo:
1. Vincula la facturación para obtener el Nivel 1
Al vincular la facturación al proyecto en AI Studio:
- Aumentan los límites de tasa.
- Se establece un tope de gasto de $250.
- No necesitas gastar dinero para desbloquear el Nivel 1.
El Nivel 2 se habilita después de gastar $100 y esperar tres días, con un tope de $2.000. El Nivel 3 requiere $1.000 de gasto y 30 días.
2. Usa las tarifas de introducción
Hasta el 31 de diciembre de 2026, Gemini 3.8 Flash cuesta:
- $0,75 por millón de tokens de entrada.
- $3,75 por millón de tokens de salida.
Los tokens de pensamiento se facturan como salida. Desde el 1 de enero de 2027, las tarifas se duplican a $1,50 y $7,50.
1.000 solicitudes con 2.000 tokens de entrada y 500 de salida cada una cuestan aproximadamente $3,38 con las tarifas de introducción. El desglose de precios de Gemini 3.8 Flash explica el cálculo por tarea y por qué un precio menor por token no siempre significa una tarea más barata.
3. Procesa por lotes lo que pueda esperar
La API por lotes reduce a la mitad las tarifas:
- $0,375 por millón de tokens de entrada.
- $1,875 por millón de tokens de salida.
Las mismas 1.000 solicitudes cuestan aproximadamente $1,69. Las cuentas de Nivel 1 pueden mantener hasta 3 millones de tokens en cola.
Las evaluaciones, cargas históricas (backfills) y trabajos nocturnos son buenos candidatos. Consulta la guía del modo por lotes de Gemini.
4. Almacena en caché el prefijo estable
El almacenamiento en caché de contexto cuesta $0,075 por millón de tokens en caché con la tarifa de introducción: una décima parte del costo de enviar entrada nueva.
Empieza por un prompt de sistema largo o un documento que reenvías en cada turno.
Lo que no obtendrás gratis
- La aplicación Gemini: requiere Google AI Pro o Ultra.
- Privacidad: los datos del nivel gratuito se utilizan para mejorar los productos de Google y no hay un interruptor para desactivarlo.
- Margen de capacidad: los límites están publicados en la página de límites de tasa y no son generosos. El nivel gratuito sirve para evaluación y herramientas pequeñas, no para un lanzamiento.
- Gemini 3.8 Flash Cyber: está restringido al Programa Fairwind para gobiernos, operadores de infraestructura y mantenedores de software. No tiene API pública, precio público ni opción de autoalojamiento.
- API en vivo, generación de imágenes y generación de audio: 3.8 Flash no admite estas funciones en ningún nivel. Acepta texto, imagen, vídeo, audio y PDF como entrada, pero solo genera texto.
- Un nivel ilimitado: los sitios que prometen acceso ilimitado probablemente usan la clave de otra persona o sirven un modelo diferente. Consulta la guía para detectar acceso gratuito e ilimitado falso a la API de Gemini. La estrategia de nivel gratuito utilizada con Gemini 3.6 Flash también aplica aquí.
Haz que la cuota gratuita rinda más con Apidog
La cuota gratuita recompensa una configuración disciplinada. Cada solicitud reescrita manualmente, cada 429 accidental y cada ejecución innecesaria con pensamiento high consume cuota que no recuperarás.
En Apidog:
- Guarda
GEMINI_API_KEYcomo variable de entorno para que nunca aparezca en el cuerpo de la solicitud ni en una colección compartida. - Guarda la solicitud de Interactions y la solicitud heredada
generateContentcon nombres. - Define como variables el prompt, el modelo y
thinking_level. - Cambia el nivel de pensamiento modificando una variable, no el JSON.
- Añade una aserción sobre el código de estado para que un
429aparezca como prueba fallida. - En el endpoint heredado, comprueba
usageMetadata.thoughtsTokenCountpara saber cuánta cuota consumió el razonamiento. - Programa una prueba de humo diaria con nivel
low.
Puedes descargar Apidog y consultar cómo programar pruebas de API en Apidog.
Preguntas frecuentes
¿Gemini 3.8 Flash es gratuito?
Sí, mediante Google AI Studio y el nivel gratuito de la API de Gemini, con límites de tasa y uso de tus datos para mejorar los productos de Google. Es el mismo modelo gemini-3.8-flash disponible en los niveles de pago.
¿Puedo usar Gemini 3.8 Flash gratis en la aplicación Gemini?
No. La aplicación ofrece 3.8 Flash a suscriptores de Google AI Pro y Ultra. El Modo IA en la Búsqueda de Google y Gemini en Hojas de cálculo son las superficies de consumo disponibles sin suscripción.
¿Cuáles son los límites de tasa?
Google los publica por modelo en la página de límites de tasa de AI Studio, no necesariamente en la documentación, y pueden cambiar. Consulta la página para tu proyecto. Si necesitas más capacidad, vincular la facturación te mueve al Nivel 1 sin necesidad de gastar.
¿El nivel gratuito incluye el pensamiento?
Sí. low, medium y high funcionan en el nivel gratuito; medium es el predeterminado. minimal devuelve un error en 3.8 Flash. Como los tokens de pensamiento cuentan para la cuota, low suele ser la mejor opción para empezar.
¿Gemini 3.8 Flash Cyber es gratuito?
No está disponible fuera del Programa Fairwind. Los desarrolladores habituales pueden usar 3.8 Flash y ejecutar sus propias pruebas de seguridad de API contra él.
Empieza gratis y decide después
El nivel gratuito es un entorno de evaluación real para Gemini 3.8 Flash. Crea una clave, usa low al principio, mantén los datos sensibles fuera del nivel gratuito y consulta los límites actuales en lugar de adivinarlos.
Cuando los errores 429 empiecen a costarte tiempo, vincula la facturación para obtener el Nivel 1 y usa procesamiento por lotes para los trabajos asíncronos. Hasta diciembre, $0,375 por millón de tokens de entrada puede costar menos que el café que tomaste esperando a que se restableciera la cuota.

Top comments (0)