DEV Community

Cover image for Como usar Gemini 3.8 Flash de graça?
Lucas
Lucas

Posted on Originally published at apidog.com

Como usar Gemini 3.8 Flash de graça?

O Gemini 3.8 Flash foi lançado em 2 de setembro de 2026 com um caminho gratuito real: você pode usá-lo no Google AI Studio sem custo e chamá-lo pela API Gemini no nível gratuito com uma chave criada em cerca de um minuto. O Google o descreve como “nosso modelo Flash mais inteligente”. O nível gratuito usa o mesmo ID gemini-3.8-flash dos clientes pagantes, sem uma variante reduzida. Veja também o anúncio de lançamento do Google.

Experimente o Apidog hoje

Há três ressalvas: o nível gratuito tem limite de taxa, os dados podem ser usados para melhorar os produtos do Google e o aplicativo Gemini não inclui o 3.8 Flash no plano gratuito. Para executar uma solicitação agora, siga este guia.

Gemini 3.8 Flash no Google AI Studio

Acesso gratuito em resumo

Superfície Custo Gemini 3.8 Flash incluído? Ressalva
Google AI Studio $0 Sim Limite de taxa; dados usados para melhorar produtos
Nível gratuito da API Gemini $0 Sim Os mesmos limites exibidos na página de limite de taxa do AI Studio
Aplicativo Gemini, plano gratuito $0 Não Requer Google AI Pro ou Ultra
Modo AI na Pesquisa Google $0 Sim, para consumidores Sem API ou controle do nível de raciocínio
Gemini no Google Sheets Depende do plano Sim, para consumidores Sem API
Fundamentação na Pesquisa Google 5.000 solicitações/mês Compartilhado entre Gemini 3.x Depois, $14 por 1.000 solicitações
API em Lote 50% de desconto nas taxas pagas Sim Não é gratuita
Gemini 3.8 Flash Cyber Não disponível para venda Não Somente o Programa Fairwind, sem API pública

Passo 1: escolha gemini-3.8-flash

Abra o Google AI Studio e entre com uma conta Google. Você não precisa de conta de faturamento nem de cartão de crédito. No seletor de modelos, escolha gemini-3.8-flash, o ID estável sem sufixo de pré-visualização.

O modelo oferece três níveis de raciocínio:

  • low (baixo)
  • medium (médio, padrão)
  • high (alto)

O nível minimal (mínimo) não existe no 3.8 Flash. Enviá-lo pela API gera um erro de validação, sem fallback silencioso. Consulte o guia de níveis de raciocínio para comparar custo em tokens e tempo.

Para começar:

  1. Mantenha a temperatura em 1.0, valor recomendado pelo Google para os modelos Gemini 3.
  2. Use low durante a exploração inicial.

O 3.8 Flash pode usar mais tokens em tarefas longas e complexas, trabalhando em etapas menores e chamando ferramentas iterativamente. A Artificial Analysis mediu cerca de 48 mil tokens de saída por tarefa no nível high, 30% a mais que o 3.7 Flash. Como tokens de raciocínio contam para os limites de tokens por minuto, low ou medium prolongam sua cota gratuita.

Passo 2: crie uma chave de API gratuita

No AI Studio, abra a página de chaves de API e crie uma chave em um projeto novo ou existente. Ela funciona imediatamente no nível gratuito, que lista entrada e saída do 3.8 Flash como “Grátis”. Se necessário, siga este passo a passo para criar uma chave da API Gemini.

Armazene a chave em uma variável de ambiente, nunca no código ou no histórico do shell:

export GEMINI_API_KEY="paste-your-key-here"
Enter fullscreen mode Exit fullscreen mode

Trate a chave como uma senha. Embora uma chave vazada do nível gratuito não gere uma fatura, ela pode consumir sua cota diária.

Passo 3: faça sua primeira chamada

Os modelos Gemini 3.x usam principalmente a API de Interações. Uma solicitação mínima com curl:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-[REDACTED CREDENTIAL] -H 'Content-Type: application/json' \
  -d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
Enter fullscreen mode Exit fullscreen mode

A resposta contém uma lista de etapas de execução — incluindo pensamentos do modelo e chamadas de ferramentas, quando houver — e termina em uma etapa model_output com o texto final.

O endpoint legado generateContent continua funcionando e é “totalmente suportado”, sem data de desativação anunciada. Nele, o nível é definido em generationConfig.thinkingConfig.thinkingLevel. O guia da API Gemini 3.8 Flash também cobre Python e conversas multi-turno com previous_interaction_id.

Se receber 429, você atingiu o limite de taxa gratuito. Aguarde ou avance para o Nível 1.

O que o nível gratuito custa

Você não paga em dinheiro, mas há três custos práticos.

Limites de taxa

O nível gratuito limita:

  • solicitações por minuto;
  • tokens por minuto;
  • solicitações por dia, por modelo.

O Google publica os valores atuais na página de limite de taxa do AI Studio, não no texto da documentação. Eles podem mudar sem changelog. Consulte também a documentação de limites de taxa e não confie em números antigos publicados em blogs.

Uso dos dados

O Google afirma que prompts e respostas do nível gratuito são usados para melhorar seus produtos. Isso pode ser aceitável para benchmarks e protótipos, mas não para registros de clientes, código-fonte não lançado ou dados sob NDA.

Para dados sensíveis, vincule o faturamento antes de enviar a solicitação. Os níveis pagos têm termos diferentes.

Consumo de tokens

O raciocínio também consome tokens. Um modelo que raciocina mais intensamente esgota a cota mais rapidamente. Por isso, use low ou medium como padrão até precisar de mais capacidade.

O aplicativo Gemini não é gratuito

No lado do consumidor, o Gemini 3.8 Flash está disponível no aplicativo Gemini para assinantes Google AI Pro e Ultra. O plano gratuito do aplicativo não o inclui. Se o aplicativo mostrar um modelo Flash sem assinatura, ele não é necessariamente o 3.8 Flash.

Você pode encontrar o modelo sem custo adicional no Modo AI da Pesquisa Google e no Gemini no Google Sheets. Porém, essas superfícies não oferecem:

  • API;
  • controle do nível de raciocínio;
  • contagem de tokens.

Para desenvolvimento, o AI Studio e o nível gratuito da API são as opções realmente gratuitas.

Fundamentação gratuita: 5.000 solicitações por mês

A fundamentação da Pesquisa Google permite que o modelo use resultados atuais da web. Ela inclui 5.000 solicitações gratuitas por mês, compartilhadas entre todos os modelos Gemini 3.x. Depois disso, custa $14 por 1.000 solicitações.

A cota é compartilhada: uma solicitação fundamentada com Gemini 3 Pro e outra com 3.8 Flash usam o mesmo pool mensal. É suficiente para protótipos, mas recursos de produção precisam de orçamento próprio.

Quando a cota acabar: opções pagas

1. Vincule o faturamento

Adicionar uma conta de faturamento ao projeto move-o para o Nível 1, aumenta os limites e define um teto de gastos de $250. Não é necessário gastar para desbloqueá-lo.

  • Nível 2: após $100 gastos e três dias, com teto de $2.000.
  • Nível 3: após $1.000 gastos e 30 dias.

2. Use o preço de introdução

Até 31 de dezembro de 2026, o 3.8 Flash custa:

  • $0,75 por milhão de tokens de entrada;
  • $3,75 por milhão de tokens de saída, incluindo tokens de raciocínio.

A partir de 1º de janeiro de 2027, os valores dobram para $1,50 e $7,50.

Mil solicitações com 2.000 tokens de entrada e 500 de saída cada custam aproximadamente $3,38 no preço de introdução. Consulte a discriminação de preços para ver o cálculo por tarefa.

3. Processe tarefas em lote

A API em Lote reduz as taxas pela metade até o fim de 2026:

  • $0,375 por milhão de tokens de entrada;
  • $1,875 por milhão de tokens de saída.

As mesmas mil solicitações custam aproximadamente $1,69. Projetos no Nível 1 podem enfileirar até 3 milhões de tokens. Use o lote para avaliações, preenchimentos retroativos e tarefas noturnas. O guia do modo de lote Gemini mostra o formato das solicitações.

4. Armazene prefixos em cache

O cache de contexto custa $0,075 por milhão de tokens na taxa de introdução — um décimo do preço de entrada nova. Prompts de sistema longos e documentos reenviados a cada turno são os melhores candidatos.

O que o nível gratuito não oferece

  • Aplicativo Gemini: requer Google AI Pro ou Ultra.
  • Privacidade adicional: os dados gratuitos são usados para melhorar os produtos do Google e não há opção de desativação nesse nível.
  • Margem de produção: os limites não são generosos; o nível gratuito serve para avaliação e ferramentas pequenas.
  • Gemini 3.8 Flash Cyber: está restrito ao Programa Fairwind, sem API pública, preço ou opção de auto-hospedagem.
  • API ao vivo, geração de imagens ou áudio: não são compatíveis com o 3.8 Flash em nenhum nível. As entradas podem incluir texto, imagem, vídeo, áudio e PDF; a saída é texto.
  • Acesso ilimitado: serviços que prometem uso irrestrito podem estar usando a chave de outra pessoa como proxy ou disponibilizando outro modelo. O guia de acesso gratuito à API Gemini explica como identificar isso.

A mesma estratégia de nível gratuito usada no Gemini 3.6 Flash continua válida: controle o nível de raciocínio, monitore o consumo e evite dados sensíveis.

Faça sua cota durar mais com o Apidog

O nível gratuito recompensa a disciplina. No Apidog:

  1. Armazene GEMINI_API_KEY como variável de ambiente para que ela não apareça no corpo da solicitação ou em coleções compartilhadas.
  2. Salve as chamadas de Interações e generateContent como solicitações nomeadas.
  3. Use uma variável para alternar low, medium e high, em vez de editar o JSON manualmente.
  4. Adicione uma asserção para o código de status e transforme um 429 em teste falho.
  5. No endpoint legado, valide usageMetadata.thoughtsTokenCount para acompanhar o consumo de raciocínio.

Depois, agende um teste de fumaça diário com uma solicitação low. Assim, você detecta alterações no comportamento do modelo ou nos limites antes dos usuários. Baixe o Apidog e consulte o guia para agendar testes de API no Apidog.

Perguntas frequentes

O Gemini 3.8 Flash é gratuito?

Sim, no Google AI Studio e no nível gratuito da API Gemini, com limites de taxa e uso dos dados para melhorar os produtos do Google. O ID é o mesmo: gemini-3.8-flash.

Posso usá-lo gratuitamente no aplicativo Gemini?

Não. O aplicativo exige Google AI Pro ou Ultra. O Modo AI da Pesquisa Google e o Gemini no Sheets são as superfícies de consumidor disponíveis sem assinatura.

Quais são os limites de taxa?

Eles aparecem por modelo na página de limite de taxa do AI Studio e podem mudar. Quando precisar de mais capacidade, vincule o faturamento para entrar no Nível 1 sem gasto obrigatório.

O nível gratuito inclui raciocínio?

Sim. low, medium e high funcionam no nível gratuito, com medium como padrão. minimal gera erro no 3.8 Flash. Como os tokens de raciocínio entram nos limites de tokens, low maximiza a duração da cota.

O Gemini 3.8 Flash Cyber é gratuito?

Não. Ele está disponível somente para participantes do Programa Fairwind. Desenvolvedores comuns podem usar o 3.8 Flash e executar seus próprios testes de segurança de API.

Comece grátis e decida depois

O nível gratuito é uma opção real para avaliar o Gemini 3.8 Flash. Crie uma chave, use low no início, mantenha dados sensíveis fora desse nível e confira os limites diretamente no AI Studio.

Quando os erros 429 começarem a interromper seu trabalho, vincule o faturamento para obter o Nível 1 e use o modo em lote para tarefas assíncronas. Até dezembro, $0,375 por milhão de tokens de entrada pode custar menos do que o tempo perdido esperando a cota gratuita ser redefinida.

Top comments (0)