DEV Community

Cover image for O que é Claude Fable 5.1? Especificações, Benchmarks, Preço e Novidades
Lucas
Lucas

Posted on Originally published at apidog.com

O que é Claude Fable 5.1? Especificações, Benchmarks, Preço e Novidades

Claude Fable 5.1: especificações, preços e migração da API

Claude Fable 5.1 é o novo modelo de nível Fable da Anthropic, lançado em 1º de setembro de 2026 com seu gêmeo de acesso restrito, Claude Mythos 5.1. Ele substitui o Claude Fable 5 pelo mesmo custo de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, mas reduz as leituras de cache para US$ 0,25 por milhão de tokens — um quarto do preço anterior. A Anthropic o posiciona para “raciocínio exigente e trabalho agêntico de longo horizonte”, embora ainda recomende começar com o Opus 5 e usar o Fable 5.1 quando o Opus 5, mesmo com maior esforço, não for suficiente. Consulte a publicação de lançamento e a página oficial do modelo Fable 5.1.

Experimente o Apidog hoje

Este guia reúne as especificações, a evolução dos preços de cache, os benchmarks publicados pela Anthropic, as três mudanças incompatíveis com o Fable 5, os novos recursos, a disponibilidade e as limitações práticas. Como cada requisição usa HTTP e JSON, você pode montá-la e inspecioná-la no Apidog antes de integrá-la à aplicação.

Claude Fable 5.1

Claude Fable 5.1 em um relance

Especificação Valor
ID do modelo da API claude-fable-5-1
Lançamento 1º de setembro de 2026
Desativação Não antes de 1º de setembro de 2027
Janela de contexto 1.000.000 tokens, padrão e máximo
Saída máxima 128.000 tokens na Messages API
Preço base US$ 10 por milhão de tokens de entrada; US$ 50 por milhão de saída
Leitura de cache US$ 0,25 por milhão de tokens (0,025x da entrada base)
API em lote US$ 5 de entrada; US$ 25 de saída por milhão
Corte de conhecimento Junho de 2026
Pensamento Adaptável e sempre ativo
Esforço low, medium, high, xhigh, max; padrão high
Latência Mais lento que Opus 5 e Sonnet 5
Nível de Prioridade Não suportado; era suportado no Fable 5
Retenção de dados 30 dias obrigatórios, salvo autorização expressa para retenção zero
Disponibilidade Claude API, Amazon Bedrock, Claude Platform na AWS, Google Cloud, Microsoft Foundry, Claude.ai e Claude Code 2.1.250+

Três pontos exigem atenção:

  • O corte de conhecimento de junho de 2026 é mais recente que o do Opus 5, de maio de 2026, e o do Sonnet 5, de janeiro de 2026.
  • O Nível de Prioridade foi removido.
  • Organizações sem retenção de 30 dias recebem 400 invalid_request_error. Verifique essa configuração antes de depurar o payload.

O que é o Claude Fable 5.1

O Fable 5.1 sucede o Fable 5 no mesmo nível, com o mesmo preço e o mesmo tokenizador introduzido com o Opus 4.7 — aproximadamente 30% mais tokens por texto do que os modelos anteriores ao 4.7.

A Anthropic descreve o Fable 5.1 e o Mythos 5.1 como “o mesmo modelo, mas com diferentes níveis de salvaguardas”. O Fable 5.1 está disponível de forma geral. O Mythos 5.1 é restrito a clientes aprovados no Project Glasswing, pelo Cyber Verification Program e pelo Life Sciences Verification Program, além de alimentar o produto Claude Security. Veja a comparação entre Mythos 5.1 e Fable 5.1.

O histórico do Fable 5 também importa: o modelo foi suspenso em junho de 2026 sob os controles de exportação dos EUA e retornou em 1º de julho com um classificador de segurança retreinado. O Fable 5.1 mantém essa arquitetura e as mesmas categorias de recusa, mas, segundo a Anthropic, os classificadores são acionados com muito menos frequência em trabalhos benignos. Consulte os artigos sobre a suspensão do Fable 5 e seu retorno.

A recomendação oficial é começar pelo Opus 5 e migrar para o Fable 5.1 quando houver necessidade de raciocínio mais exigente, trabalho agêntico de longo horizonte ou desempenho insuficiente no Opus 5 com esforço alto. A comparação entre Fable 5.1 e Opus 5 detalha essa escolha por carga de trabalho.

Preços de leitura de cache

Os preços-base não mudaram; o multiplicador da leitura de cache mudou:

Modelo Entrada base Leitura de cache Saída
Claude Fable 5.1 US$ 10 US$ 0,25 US$ 50
Claude Fable 5 US$ 10 US$ 1,00 US$ 50
Claude Opus 5 US$ 5 US$ 0,50 US$ 25
Claude Sonnet 5 US$ 2 US$ 0,20 US$ 10

Um acerto de cache do Fable 5.1 custa menos que um acerto do Opus 5, apesar de seu preço-base ser o dobro. Em sessões agênticas longas, que releem um prefixo em cache a cada turno, a economia tende a ser maior.

A Anthropic estima redução de 25% em cargas típicas e de até aproximadamente 45% em cargas altamente agênticas. O resultado depende da sua taxa de acerto de cache; veja o cálculo detalhado de custos.

As gravações de cache — US$ 12,50 e US$ 20 por milhão de tokens — e o mínimo de 512 tokens permanecem inalterados. Como uma falha custa 40 vezes mais que um acerto, manter o cache aquecido é especialmente importante no Fable 5.1.

O que os benchmarks mostram

Os resultados abaixo foram executados pela Anthropic e ainda não têm reprodução independente:

Benchmark Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1 52,6% 24,7% 29,0% 22,4%
Terminal-Bench 4.0 55,8% 42,0% 52,3% 37,3%
GDPval-AA v2 1853 1723 1824 1711
OSWorld 2.0 — crédito parcial 77,9% 72,9% 75,4% Não reportado
OSWorld 2.0 — estrito 41,7% 36,1% 39,6% Não reportado
Último Exame da Humanidade — sem ferramentas 60,9% 57,8% 56,6% Não reportado
Último Exame da Humanidade — com ferramentas 65,0% 63,8% 63,6% Não reportado
AutomationBench 31,4% 17,1% 26,9% 19,6%
CursorBench 3.2.0 73,4% 70,5% 70,0% 67,2%

A Anthropic também reporta 60,9% para o Mythos 5.1 no Terminal-Bench 4.0, cinco pontos acima do Fable 5.1. A análise detalhada dos benchmarks examina os resultados linha por linha.

O maior destaque é o Terminal-Bench-Science, que mais que dobra o resultado do Fable 5. No CursorBench, a vantagem sobre o Opus 5 é de 3,4 pontos: real, mas modesta para um modelo com preço-base duas vezes maior.

Três mudanças que quebram código do Fable 5

A migração é relativamente direta, mas estas três situações podem retornar 400:

1. tool_choice forçado não é suportado

Estas configurações são rejeitadas:

{"type": "any"}
Enter fullscreen mode Exit fullscreen mode
{"type": "tool", "name": "..."}
Enter fullscreen mode Exit fullscreen mode

A API retorna:

tool_choice: type "tool" and "any" are not supported for this model
Enter fullscreen mode Exit fullscreen mode

Use auto e instrua explicitamente o modelo a chamar a ferramenta. Se precisar de argumentos válidos segundo o esquema, defina strict: true. Quando a chamada forçada servia apenas para obter JSON, prefira saídas estruturadas.

2. Modelos antigos não leem blocos de pensamento do Fable 5.1

O Fable 5.1 consegue ler blocos de pensamento do Opus 5, Fable 5 e modelos anteriores, mas o inverso não é verdadeiro. Se um roteador, nova tentativa ou fallback mover a conversa para o Opus 5, a API descarta esses blocos sem cobrança e o modelo de destino replaneja.

3. Editar turnos anteriores invalida o pensamento

Um bloco de pensamento só é válido em relação ao prompt de sistema, ao array de ferramentas e ao histórico exatos que o precederam. Alterar qualquer um deles provoca um 400 informando que o bloco está “vinculado a uma conversa diferente”.

Essa verificação vale para contas criadas em ou após 31 de agosto de 2026 e é descrita pela Anthropic como uma medida anti-destilação. Se o código monta o array messages manualmente, use o guia de pensamento preservado, incluindo a opção de escape drop_block e padrões apenas de adição para preservar pensamento e cache.

O restante permanece igual:

  • O pensamento não pode ser desativado.
  • O preenchimento retorna 400.
  • Um valor não padrão de temperature retorna 400.
  • thinking.display assume o padrão "omitted".

Consulte o guia de migração do Fable 5 e Opus 5 para ver os trechos antes e depois.

Cinco recursos adicionais

  1. Esforço por mensagem — beta

    Uma mensagem role: "system" com conteúdo vazio e output_config: {"effort": "low"} altera o esforço a partir do próximo turno do usuário sem invalidar o cache. Requer o cabeçalho mid-conversation-output-config-2026-07-01.

  2. Mensagens de sistema com escopo de turno — beta

    clear_at: "next_user_message" dá autoridade a uma mensagem de sistema no meio da conversa por apenas um turno. Requer mid-conversation-system-clear-at-2026-08-21.

  3. Atualizações de progresso entre chamadas de ferramentas — beta

    thinking.display: "updates" retorna notas do modelo entre as ferramentas como texto, mantendo o raciocínio oculto. Requer thinking-display-updates-2026-08-18.

  4. Preço de leitura de cache reduzido

    O Fable 5.1 e o Mythos 5.1 usam o multiplicador 0,025x, contra 0,1x nos demais modelos Claude.

  5. Proveniência de conteúdo

    O texto recebe a marca d’água estatística da Anthropic em todas as plataformas. Mídias compatíveis da sandbox de execução de código recebem credenciais C2PA pela Files API. Veja o explicador de marca d’água.

Como o comportamento muda

O guia oficial de prompting e o guia de prompt do Apidog descrevem diferenças que aparecem sem alterações na API:

  • Uma chamada de ferramenta por turno em loops agênticos longos, em vez de várias como no Fable 5.
  • Menos mensagens de progresso entre chamadas de ferramentas.
  • Mais respostas vindas da memória com esforço low.
  • Prosa mais densa.
  • Menos formatação de chat.
  • Citações não marcadas em resumos.
  • Reescritas de arquivos inteiros.

Comece com esforço high e refaça suas avaliações. Segundo a Anthropic, medium se aproxima do Fable 5 com custo menor.

O teto honesto: recusas e salvaguardas

O Fable 5.1 ainda executa classificadores de segurança. Uma requisição recusada retorna HTTP 200 com:

stop_reason: "refusal"
stop_details.category: "cyber" | "bio" | "frontier_llm" | "reasoning_extraction" | "general_harms"
Enter fullscreen mode Exit fullscreen mode

A Anthropic relata:

  • Classificadores de biologia acionados 85% menos em perguntas benignas que os do Fable 5 no lançamento.
  • Aproximadamente 60% menos intervenções cibernéticas por sessão no Claude Code.
  • Capacidade de identificar vulnerabilidades em códigos que você possui, mas não desenvolver exploits.

O desenvolvimento de exploits continua reservado ao Mythos 5.1.

Trate recusas explicitamente no código. Os fallbacks permitidos são Opus 4.8 e Opus 5. A configuração mais simples é fallbacks: "default" com o cabeçalho server-side-fallback-2026-07-01. Uma recusa antes de qualquer saída não é cobrada.

O guia de tratamento de recusas continua válido, com uma ressalva: o modelo de fallback não consegue ler os blocos de pensamento do Fable 5.1. O Mythos 5.1 supera o Fable 5.1 nos benchmarks publicados para ambos, e os classificadores do Fable são mais amplos que o conjunto exclusivamente cibernético do Opus 5.

Salvaguardas e integração do Claude Fable 5.1

Onde executar o Fable 5.1

O modelo está disponível em:

  • Claude API: claude-fable-5-1
  • Amazon Bedrock: anthropic.claude-fable-5-1
  • Claude Platform na AWS, Google Cloud e Microsoft Foundry: claude-fable-5-1
  • Claude.ai: planos Pro, Max, Team e Enterprise — não no plano Gratuito
  • Claude Code: versão 2.1.250 ou posterior

No Max, os modelos Fable estão disponíveis para até 50% do limite semanal. No Pro, o uso é contabilizado por créditos. Consulte o guia de disponibilidade em nuvem, o guia do Claude Code, o guia de opções gratuitas e econômicas e o Claude.ai.

Testando requisições no Apidog

No Apidog, crie uma requisição POST para https://api.anthropic.com/v1/messages com os cabeçalhos x-api-key e anthropic-version: 2023-06-01.

Use este corpo:

{
  "model": "claude-fable-5-1",
  "max_tokens": 16000,
  "output_config": {"effort": "high"},
  "messages": [
    {
      "role": "user",
      "content": "Revise este handler de paginação e liste os casos de borda que ele não considera."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Nenhum campo thinking é necessário. Reserve espaço em max_tokens, pois esse limite vale para o pensamento e a resposta juntos.

Ao testar:

  1. Verifique stop_reason antes de ler content.
  2. Ramifique para o tratamento de refusal.
  3. Confirme o bloco thinking vazio.
  4. Envie uma segunda requisição e verifique usage.cache_read_input_tokens.
  5. Compare o custo da leitura de cache de US$ 0,25 por milhão de tokens.
  6. Baixe o Apidog para salvar o caso de teste.

Quem deve usar o Claude Fable 5.1

Considere o modelo quando:

  • Seus agentes executam por horas.
  • Você usa o Fable 5 atualmente — mesmo preço, cache mais barato e melhores resultados publicados.
  • O Opus 5 em xhigh ainda falha nas suas avaliações.
  • Você precisa de conhecimento atualizado até junho de 2026.

Mantenha o modelo atual quando:

  • O Nível de Prioridade for essencial.
  • Sua organização exigir retenção zero de dados.
  • Seu sistema editar o histórico de conversas.
  • A carga for barata e de alto volume, atendida pelo Opus 5 ou Sonnet 5.

Veja também a comparação entre Fable 5.1 e Fable 5 e o material sobre Sonnet 5.

FAQ

Qual é o ID do Claude Fable 5.1?

Use exatamente claude-fable-5-1. No Amazon Bedrock, use anthropic.claude-fable-5-1.

Quanto custa o Claude Fable 5.1?

US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, o mesmo preço do Fable 5. Leituras de cache custam US$ 0,25 por milhão. O processamento em lote custa US$ 5 para entrada e US$ 25 para saída. Não há modo rápido nem Nível de Prioridade.

O Fable 5.1 é melhor que o Fable 5?

Nos benchmarks publicados pela Anthropic, sim. Os maiores ganhos aparecem no Terminal-Bench-Science, com 52,6% contra 24,7%, e no AutomationBench, com 31,4% contra 17,1%. Esses resultados foram executados pelo fornecedor.

O que quebra ao migrar do Fable 5?

tool_choice forçado retorna 400, modelos mais antigos não conseguem ler blocos de pensamento do Fable 5.1 e editar turnos anteriores invalida blocos posteriores em contas criadas em ou após 31 de agosto de 2026.

O Fable 5.1 recusa requisições de cibersegurança?

Às vezes. A Anthropic relata aproximadamente 60% menos intervenções cibernéticas por sessão no Claude Code e permite identificar vulnerabilidades em códigos. O desenvolvimento de exploits continua sendo recusado.

Posso usar o Claude Fable 5.1 gratuitamente?

Não no plano Gratuito. O Pro usa créditos de uso, e o Max inclui modelos Fable para até 50% do limite semanal. A API não oferece nível gratuito além do crédito de inscrição.

Top comments (0)