O Gemini 3.8 Flash foi lançado em 2 de setembro de 2026 com um caminho gratuito real: você pode usá-lo no Google AI Studio sem custo e chamá-lo pela API Gemini no nível gratuito com uma chave criada em cerca de um minuto. O Google o descreve como “nosso modelo Flash mais inteligente”. O nível gratuito usa o mesmo ID gemini-3.8-flash dos clientes pagantes, sem uma variante reduzida. Veja também o anúncio de lançamento do Google.
Há três ressalvas: o nível gratuito tem limite de taxa, os dados podem ser usados para melhorar os produtos do Google e o aplicativo Gemini não inclui o 3.8 Flash no plano gratuito. Para executar uma solicitação agora, siga este guia.
Acesso gratuito em resumo
| Superfície | Custo | Gemini 3.8 Flash incluído? | Ressalva |
|---|---|---|---|
| Google AI Studio | $0 | Sim | Limite de taxa; dados usados para melhorar produtos |
| Nível gratuito da API Gemini | $0 | Sim | Os mesmos limites exibidos na página de limite de taxa do AI Studio |
| Aplicativo Gemini, plano gratuito | $0 | Não | Requer Google AI Pro ou Ultra |
| Modo AI na Pesquisa Google | $0 | Sim, para consumidores | Sem API ou controle do nível de raciocínio |
| Gemini no Google Sheets | Depende do plano | Sim, para consumidores | Sem API |
| Fundamentação na Pesquisa Google | 5.000 solicitações/mês | Compartilhado entre Gemini 3.x | Depois, $14 por 1.000 solicitações |
| API em Lote | 50% de desconto nas taxas pagas | Sim | Não é gratuita |
| Gemini 3.8 Flash Cyber | Não disponível para venda | Não | Somente o Programa Fairwind, sem API pública |
Passo 1: escolha gemini-3.8-flash
Abra o Google AI Studio e entre com uma conta Google. Você não precisa de conta de faturamento nem de cartão de crédito. No seletor de modelos, escolha gemini-3.8-flash, o ID estável sem sufixo de pré-visualização.
O modelo oferece três níveis de raciocínio:
-
low(baixo) -
medium(médio, padrão) -
high(alto)
O nível minimal (mínimo) não existe no 3.8 Flash. Enviá-lo pela API gera um erro de validação, sem fallback silencioso. Consulte o guia de níveis de raciocínio para comparar custo em tokens e tempo.
Para começar:
- Mantenha a temperatura em
1.0, valor recomendado pelo Google para os modelos Gemini 3. - Use
lowdurante a exploração inicial.
O 3.8 Flash pode usar mais tokens em tarefas longas e complexas, trabalhando em etapas menores e chamando ferramentas iterativamente. A Artificial Analysis mediu cerca de 48 mil tokens de saída por tarefa no nível high, 30% a mais que o 3.7 Flash. Como tokens de raciocínio contam para os limites de tokens por minuto, low ou medium prolongam sua cota gratuita.
Passo 2: crie uma chave de API gratuita
No AI Studio, abra a página de chaves de API e crie uma chave em um projeto novo ou existente. Ela funciona imediatamente no nível gratuito, que lista entrada e saída do 3.8 Flash como “Grátis”. Se necessário, siga este passo a passo para criar uma chave da API Gemini.
Armazene a chave em uma variável de ambiente, nunca no código ou no histórico do shell:
export GEMINI_API_KEY="paste-your-key-here"
Trate a chave como uma senha. Embora uma chave vazada do nível gratuito não gere uma fatura, ela pode consumir sua cota diária.
Passo 3: faça sua primeira chamada
Os modelos Gemini 3.x usam principalmente a API de Interações. Uma solicitação mínima com curl:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-[REDACTED CREDENTIAL] -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
A resposta contém uma lista de etapas de execução — incluindo pensamentos do modelo e chamadas de ferramentas, quando houver — e termina em uma etapa model_output com o texto final.
O endpoint legado generateContent continua funcionando e é “totalmente suportado”, sem data de desativação anunciada. Nele, o nível é definido em generationConfig.thinkingConfig.thinkingLevel. O guia da API Gemini 3.8 Flash também cobre Python e conversas multi-turno com previous_interaction_id.
Se receber 429, você atingiu o limite de taxa gratuito. Aguarde ou avance para o Nível 1.
O que o nível gratuito custa
Você não paga em dinheiro, mas há três custos práticos.
Limites de taxa
O nível gratuito limita:
- solicitações por minuto;
- tokens por minuto;
- solicitações por dia, por modelo.
O Google publica os valores atuais na página de limite de taxa do AI Studio, não no texto da documentação. Eles podem mudar sem changelog. Consulte também a documentação de limites de taxa e não confie em números antigos publicados em blogs.
Uso dos dados
O Google afirma que prompts e respostas do nível gratuito são usados para melhorar seus produtos. Isso pode ser aceitável para benchmarks e protótipos, mas não para registros de clientes, código-fonte não lançado ou dados sob NDA.
Para dados sensíveis, vincule o faturamento antes de enviar a solicitação. Os níveis pagos têm termos diferentes.
Consumo de tokens
O raciocínio também consome tokens. Um modelo que raciocina mais intensamente esgota a cota mais rapidamente. Por isso, use low ou medium como padrão até precisar de mais capacidade.
O aplicativo Gemini não é gratuito
No lado do consumidor, o Gemini 3.8 Flash está disponível no aplicativo Gemini para assinantes Google AI Pro e Ultra. O plano gratuito do aplicativo não o inclui. Se o aplicativo mostrar um modelo Flash sem assinatura, ele não é necessariamente o 3.8 Flash.
Você pode encontrar o modelo sem custo adicional no Modo AI da Pesquisa Google e no Gemini no Google Sheets. Porém, essas superfícies não oferecem:
- API;
- controle do nível de raciocínio;
- contagem de tokens.
Para desenvolvimento, o AI Studio e o nível gratuito da API são as opções realmente gratuitas.
Fundamentação gratuita: 5.000 solicitações por mês
A fundamentação da Pesquisa Google permite que o modelo use resultados atuais da web. Ela inclui 5.000 solicitações gratuitas por mês, compartilhadas entre todos os modelos Gemini 3.x. Depois disso, custa $14 por 1.000 solicitações.
A cota é compartilhada: uma solicitação fundamentada com Gemini 3 Pro e outra com 3.8 Flash usam o mesmo pool mensal. É suficiente para protótipos, mas recursos de produção precisam de orçamento próprio.
Quando a cota acabar: opções pagas
1. Vincule o faturamento
Adicionar uma conta de faturamento ao projeto move-o para o Nível 1, aumenta os limites e define um teto de gastos de $250. Não é necessário gastar para desbloqueá-lo.
- Nível 2: após $100 gastos e três dias, com teto de $2.000.
- Nível 3: após $1.000 gastos e 30 dias.
2. Use o preço de introdução
Até 31 de dezembro de 2026, o 3.8 Flash custa:
- $0,75 por milhão de tokens de entrada;
- $3,75 por milhão de tokens de saída, incluindo tokens de raciocínio.
A partir de 1º de janeiro de 2027, os valores dobram para $1,50 e $7,50.
Mil solicitações com 2.000 tokens de entrada e 500 de saída cada custam aproximadamente $3,38 no preço de introdução. Consulte a discriminação de preços para ver o cálculo por tarefa.
3. Processe tarefas em lote
A API em Lote reduz as taxas pela metade até o fim de 2026:
- $0,375 por milhão de tokens de entrada;
- $1,875 por milhão de tokens de saída.
As mesmas mil solicitações custam aproximadamente $1,69. Projetos no Nível 1 podem enfileirar até 3 milhões de tokens. Use o lote para avaliações, preenchimentos retroativos e tarefas noturnas. O guia do modo de lote Gemini mostra o formato das solicitações.
4. Armazene prefixos em cache
O cache de contexto custa $0,075 por milhão de tokens na taxa de introdução — um décimo do preço de entrada nova. Prompts de sistema longos e documentos reenviados a cada turno são os melhores candidatos.
O que o nível gratuito não oferece
- Aplicativo Gemini: requer Google AI Pro ou Ultra.
- Privacidade adicional: os dados gratuitos são usados para melhorar os produtos do Google e não há opção de desativação nesse nível.
- Margem de produção: os limites não são generosos; o nível gratuito serve para avaliação e ferramentas pequenas.
- Gemini 3.8 Flash Cyber: está restrito ao Programa Fairwind, sem API pública, preço ou opção de auto-hospedagem.
- API ao vivo, geração de imagens ou áudio: não são compatíveis com o 3.8 Flash em nenhum nível. As entradas podem incluir texto, imagem, vídeo, áudio e PDF; a saída é texto.
- Acesso ilimitado: serviços que prometem uso irrestrito podem estar usando a chave de outra pessoa como proxy ou disponibilizando outro modelo. O guia de acesso gratuito à API Gemini explica como identificar isso.
A mesma estratégia de nível gratuito usada no Gemini 3.6 Flash continua válida: controle o nível de raciocínio, monitore o consumo e evite dados sensíveis.
Faça sua cota durar mais com o Apidog
O nível gratuito recompensa a disciplina. No Apidog:
- Armazene
GEMINI_API_KEYcomo variável de ambiente para que ela não apareça no corpo da solicitação ou em coleções compartilhadas. - Salve as chamadas de Interações e
generateContentcomo solicitações nomeadas. - Use uma variável para alternar
low,mediumehigh, em vez de editar o JSON manualmente. - Adicione uma asserção para o código de status e transforme um
429em teste falho. - No endpoint legado, valide
usageMetadata.thoughtsTokenCountpara acompanhar o consumo de raciocínio.
Depois, agende um teste de fumaça diário com uma solicitação low. Assim, você detecta alterações no comportamento do modelo ou nos limites antes dos usuários. Baixe o Apidog e consulte o guia para agendar testes de API no Apidog.
Perguntas frequentes
O Gemini 3.8 Flash é gratuito?
Sim, no Google AI Studio e no nível gratuito da API Gemini, com limites de taxa e uso dos dados para melhorar os produtos do Google. O ID é o mesmo: gemini-3.8-flash.
Posso usá-lo gratuitamente no aplicativo Gemini?
Não. O aplicativo exige Google AI Pro ou Ultra. O Modo AI da Pesquisa Google e o Gemini no Sheets são as superfícies de consumidor disponíveis sem assinatura.
Quais são os limites de taxa?
Eles aparecem por modelo na página de limite de taxa do AI Studio e podem mudar. Quando precisar de mais capacidade, vincule o faturamento para entrar no Nível 1 sem gasto obrigatório.
O nível gratuito inclui raciocínio?
Sim. low, medium e high funcionam no nível gratuito, com medium como padrão. minimal gera erro no 3.8 Flash. Como os tokens de raciocínio entram nos limites de tokens, low maximiza a duração da cota.
O Gemini 3.8 Flash Cyber é gratuito?
Não. Ele está disponível somente para participantes do Programa Fairwind. Desenvolvedores comuns podem usar o 3.8 Flash e executar seus próprios testes de segurança de API.
Comece grátis e decida depois
O nível gratuito é uma opção real para avaliar o Gemini 3.8 Flash. Crie uma chave, use low no início, mantenha dados sensíveis fora desse nível e confira os limites diretamente no AI Studio.
Quando os erros 429 começarem a interromper seu trabalho, vincule o faturamento para obter o Nível 1 e use o modo em lote para tarefas assíncronas. Até dezembro, $0,375 por milhão de tokens de entrada pode custar menos do que o tempo perdido esperando a cota gratuita ser redefinida.

Top comments (0)