Claude Fable 5.1: especificações, preços e migração da API
Claude Fable 5.1 é o novo modelo de nível Fable da Anthropic, lançado em 1º de setembro de 2026 com seu gêmeo de acesso restrito, Claude Mythos 5.1. Ele substitui o Claude Fable 5 pelo mesmo custo de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, mas reduz as leituras de cache para US$ 0,25 por milhão de tokens — um quarto do preço anterior. A Anthropic o posiciona para “raciocínio exigente e trabalho agêntico de longo horizonte”, embora ainda recomende começar com o Opus 5 e usar o Fable 5.1 quando o Opus 5, mesmo com maior esforço, não for suficiente. Consulte a publicação de lançamento e a página oficial do modelo Fable 5.1.
Este guia reúne as especificações, a evolução dos preços de cache, os benchmarks publicados pela Anthropic, as três mudanças incompatíveis com o Fable 5, os novos recursos, a disponibilidade e as limitações práticas. Como cada requisição usa HTTP e JSON, você pode montá-la e inspecioná-la no Apidog antes de integrá-la à aplicação.
Claude Fable 5.1 em um relance
| Especificação | Valor |
|---|---|
| ID do modelo da API | claude-fable-5-1 |
| Lançamento | 1º de setembro de 2026 |
| Desativação | Não antes de 1º de setembro de 2027 |
| Janela de contexto | 1.000.000 tokens, padrão e máximo |
| Saída máxima | 128.000 tokens na Messages API |
| Preço base | US$ 10 por milhão de tokens de entrada; US$ 50 por milhão de saída |
| Leitura de cache | US$ 0,25 por milhão de tokens (0,025x da entrada base) |
| API em lote | US$ 5 de entrada; US$ 25 de saída por milhão |
| Corte de conhecimento | Junho de 2026 |
| Pensamento | Adaptável e sempre ativo |
| Esforço |
low, medium, high, xhigh, max; padrão high
|
| Latência | Mais lento que Opus 5 e Sonnet 5 |
| Nível de Prioridade | Não suportado; era suportado no Fable 5 |
| Retenção de dados | 30 dias obrigatórios, salvo autorização expressa para retenção zero |
| Disponibilidade | Claude API, Amazon Bedrock, Claude Platform na AWS, Google Cloud, Microsoft Foundry, Claude.ai e Claude Code 2.1.250+ |
Três pontos exigem atenção:
- O corte de conhecimento de junho de 2026 é mais recente que o do Opus 5, de maio de 2026, e o do Sonnet 5, de janeiro de 2026.
- O Nível de Prioridade foi removido.
- Organizações sem retenção de 30 dias recebem
400 invalid_request_error. Verifique essa configuração antes de depurar o payload.
O que é o Claude Fable 5.1
O Fable 5.1 sucede o Fable 5 no mesmo nível, com o mesmo preço e o mesmo tokenizador introduzido com o Opus 4.7 — aproximadamente 30% mais tokens por texto do que os modelos anteriores ao 4.7.
A Anthropic descreve o Fable 5.1 e o Mythos 5.1 como “o mesmo modelo, mas com diferentes níveis de salvaguardas”. O Fable 5.1 está disponível de forma geral. O Mythos 5.1 é restrito a clientes aprovados no Project Glasswing, pelo Cyber Verification Program e pelo Life Sciences Verification Program, além de alimentar o produto Claude Security. Veja a comparação entre Mythos 5.1 e Fable 5.1.
O histórico do Fable 5 também importa: o modelo foi suspenso em junho de 2026 sob os controles de exportação dos EUA e retornou em 1º de julho com um classificador de segurança retreinado. O Fable 5.1 mantém essa arquitetura e as mesmas categorias de recusa, mas, segundo a Anthropic, os classificadores são acionados com muito menos frequência em trabalhos benignos. Consulte os artigos sobre a suspensão do Fable 5 e seu retorno.
A recomendação oficial é começar pelo Opus 5 e migrar para o Fable 5.1 quando houver necessidade de raciocínio mais exigente, trabalho agêntico de longo horizonte ou desempenho insuficiente no Opus 5 com esforço alto. A comparação entre Fable 5.1 e Opus 5 detalha essa escolha por carga de trabalho.
Preços de leitura de cache
Os preços-base não mudaram; o multiplicador da leitura de cache mudou:
| Modelo | Entrada base | Leitura de cache | Saída |
|---|---|---|---|
| Claude Fable 5.1 | US$ 10 | US$ 0,25 | US$ 50 |
| Claude Fable 5 | US$ 10 | US$ 1,00 | US$ 50 |
| Claude Opus 5 | US$ 5 | US$ 0,50 | US$ 25 |
| Claude Sonnet 5 | US$ 2 | US$ 0,20 | US$ 10 |
Um acerto de cache do Fable 5.1 custa menos que um acerto do Opus 5, apesar de seu preço-base ser o dobro. Em sessões agênticas longas, que releem um prefixo em cache a cada turno, a economia tende a ser maior.
A Anthropic estima redução de 25% em cargas típicas e de até aproximadamente 45% em cargas altamente agênticas. O resultado depende da sua taxa de acerto de cache; veja o cálculo detalhado de custos.
As gravações de cache — US$ 12,50 e US$ 20 por milhão de tokens — e o mínimo de 512 tokens permanecem inalterados. Como uma falha custa 40 vezes mais que um acerto, manter o cache aquecido é especialmente importante no Fable 5.1.
O que os benchmarks mostram
Os resultados abaixo foram executados pela Anthropic e ainda não têm reprodução independente:
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| Terminal-Bench 4.0 | 55,8% | 42,0% | 52,3% | 37,3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 — crédito parcial | 77,9% | 72,9% | 75,4% | Não reportado |
| OSWorld 2.0 — estrito | 41,7% | 36,1% | 39,6% | Não reportado |
| Último Exame da Humanidade — sem ferramentas | 60,9% | 57,8% | 56,6% | Não reportado |
| Último Exame da Humanidade — com ferramentas | 65,0% | 63,8% | 63,6% | Não reportado |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
A Anthropic também reporta 60,9% para o Mythos 5.1 no Terminal-Bench 4.0, cinco pontos acima do Fable 5.1. A análise detalhada dos benchmarks examina os resultados linha por linha.
O maior destaque é o Terminal-Bench-Science, que mais que dobra o resultado do Fable 5. No CursorBench, a vantagem sobre o Opus 5 é de 3,4 pontos: real, mas modesta para um modelo com preço-base duas vezes maior.
Três mudanças que quebram código do Fable 5
A migração é relativamente direta, mas estas três situações podem retornar 400:
1. tool_choice forçado não é suportado
Estas configurações são rejeitadas:
{"type": "any"}
{"type": "tool", "name": "..."}
A API retorna:
tool_choice: type "tool" and "any" are not supported for this model
Use auto e instrua explicitamente o modelo a chamar a ferramenta. Se precisar de argumentos válidos segundo o esquema, defina strict: true. Quando a chamada forçada servia apenas para obter JSON, prefira saídas estruturadas.
2. Modelos antigos não leem blocos de pensamento do Fable 5.1
O Fable 5.1 consegue ler blocos de pensamento do Opus 5, Fable 5 e modelos anteriores, mas o inverso não é verdadeiro. Se um roteador, nova tentativa ou fallback mover a conversa para o Opus 5, a API descarta esses blocos sem cobrança e o modelo de destino replaneja.
3. Editar turnos anteriores invalida o pensamento
Um bloco de pensamento só é válido em relação ao prompt de sistema, ao array de ferramentas e ao histórico exatos que o precederam. Alterar qualquer um deles provoca um 400 informando que o bloco está “vinculado a uma conversa diferente”.
Essa verificação vale para contas criadas em ou após 31 de agosto de 2026 e é descrita pela Anthropic como uma medida anti-destilação. Se o código monta o array messages manualmente, use o guia de pensamento preservado, incluindo a opção de escape drop_block e padrões apenas de adição para preservar pensamento e cache.
O restante permanece igual:
- O pensamento não pode ser desativado.
- O preenchimento retorna
400. - Um valor não padrão de
temperatureretorna400. -
thinking.displayassume o padrão"omitted".
Consulte o guia de migração do Fable 5 e Opus 5 para ver os trechos antes e depois.
Cinco recursos adicionais
Esforço por mensagem — beta
Uma mensagemrole: "system"com conteúdo vazio eoutput_config: {"effort": "low"}altera o esforço a partir do próximo turno do usuário sem invalidar o cache. Requer o cabeçalhomid-conversation-output-config-2026-07-01.Mensagens de sistema com escopo de turno — beta
clear_at: "next_user_message"dá autoridade a uma mensagem de sistema no meio da conversa por apenas um turno. Requermid-conversation-system-clear-at-2026-08-21.Atualizações de progresso entre chamadas de ferramentas — beta
thinking.display: "updates"retorna notas do modelo entre as ferramentas como texto, mantendo o raciocínio oculto. Requerthinking-display-updates-2026-08-18.Preço de leitura de cache reduzido
O Fable 5.1 e o Mythos 5.1 usam o multiplicador0,025x, contra0,1xnos demais modelos Claude.Proveniência de conteúdo
O texto recebe a marca d’água estatística da Anthropic em todas as plataformas. Mídias compatíveis da sandbox de execução de código recebem credenciais C2PA pela Files API. Veja o explicador de marca d’água.
Como o comportamento muda
O guia oficial de prompting e o guia de prompt do Apidog descrevem diferenças que aparecem sem alterações na API:
- Uma chamada de ferramenta por turno em loops agênticos longos, em vez de várias como no Fable 5.
- Menos mensagens de progresso entre chamadas de ferramentas.
- Mais respostas vindas da memória com esforço
low. - Prosa mais densa.
- Menos formatação de chat.
- Citações não marcadas em resumos.
- Reescritas de arquivos inteiros.
Comece com esforço high e refaça suas avaliações. Segundo a Anthropic, medium se aproxima do Fable 5 com custo menor.
O teto honesto: recusas e salvaguardas
O Fable 5.1 ainda executa classificadores de segurança. Uma requisição recusada retorna HTTP 200 com:
stop_reason: "refusal"
stop_details.category: "cyber" | "bio" | "frontier_llm" | "reasoning_extraction" | "general_harms"
A Anthropic relata:
- Classificadores de biologia acionados 85% menos em perguntas benignas que os do Fable 5 no lançamento.
- Aproximadamente 60% menos intervenções cibernéticas por sessão no Claude Code.
- Capacidade de identificar vulnerabilidades em códigos que você possui, mas não desenvolver exploits.
O desenvolvimento de exploits continua reservado ao Mythos 5.1.
Trate recusas explicitamente no código. Os fallbacks permitidos são Opus 4.8 e Opus 5. A configuração mais simples é fallbacks: "default" com o cabeçalho server-side-fallback-2026-07-01. Uma recusa antes de qualquer saída não é cobrada.
O guia de tratamento de recusas continua válido, com uma ressalva: o modelo de fallback não consegue ler os blocos de pensamento do Fable 5.1. O Mythos 5.1 supera o Fable 5.1 nos benchmarks publicados para ambos, e os classificadores do Fable são mais amplos que o conjunto exclusivamente cibernético do Opus 5.
Onde executar o Fable 5.1
O modelo está disponível em:
- Claude API:
claude-fable-5-1 - Amazon Bedrock:
anthropic.claude-fable-5-1 - Claude Platform na AWS, Google Cloud e Microsoft Foundry:
claude-fable-5-1 - Claude.ai: planos Pro, Max, Team e Enterprise — não no plano Gratuito
- Claude Code: versão 2.1.250 ou posterior
No Max, os modelos Fable estão disponíveis para até 50% do limite semanal. No Pro, o uso é contabilizado por créditos. Consulte o guia de disponibilidade em nuvem, o guia do Claude Code, o guia de opções gratuitas e econômicas e o Claude.ai.
Testando requisições no Apidog
No Apidog, crie uma requisição POST para https://api.anthropic.com/v1/messages com os cabeçalhos x-api-key e anthropic-version: 2023-06-01.
Use este corpo:
{
"model": "claude-fable-5-1",
"max_tokens": 16000,
"output_config": {"effort": "high"},
"messages": [
{
"role": "user",
"content": "Revise este handler de paginação e liste os casos de borda que ele não considera."
}
]
}
Nenhum campo thinking é necessário. Reserve espaço em max_tokens, pois esse limite vale para o pensamento e a resposta juntos.
Ao testar:
- Verifique
stop_reasonantes de lercontent. - Ramifique para o tratamento de
refusal. - Confirme o bloco
thinkingvazio. - Envie uma segunda requisição e verifique
usage.cache_read_input_tokens. - Compare o custo da leitura de cache de US$ 0,25 por milhão de tokens.
- Baixe o Apidog para salvar o caso de teste.
Quem deve usar o Claude Fable 5.1
Considere o modelo quando:
- Seus agentes executam por horas.
- Você usa o Fable 5 atualmente — mesmo preço, cache mais barato e melhores resultados publicados.
- O Opus 5 em
xhighainda falha nas suas avaliações. - Você precisa de conhecimento atualizado até junho de 2026.
Mantenha o modelo atual quando:
- O Nível de Prioridade for essencial.
- Sua organização exigir retenção zero de dados.
- Seu sistema editar o histórico de conversas.
- A carga for barata e de alto volume, atendida pelo Opus 5 ou Sonnet 5.
Veja também a comparação entre Fable 5.1 e Fable 5 e o material sobre Sonnet 5.
FAQ
Qual é o ID do Claude Fable 5.1?
Use exatamente claude-fable-5-1. No Amazon Bedrock, use anthropic.claude-fable-5-1.
Quanto custa o Claude Fable 5.1?
US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, o mesmo preço do Fable 5. Leituras de cache custam US$ 0,25 por milhão. O processamento em lote custa US$ 5 para entrada e US$ 25 para saída. Não há modo rápido nem Nível de Prioridade.
O Fable 5.1 é melhor que o Fable 5?
Nos benchmarks publicados pela Anthropic, sim. Os maiores ganhos aparecem no Terminal-Bench-Science, com 52,6% contra 24,7%, e no AutomationBench, com 31,4% contra 17,1%. Esses resultados foram executados pelo fornecedor.
O que quebra ao migrar do Fable 5?
tool_choice forçado retorna 400, modelos mais antigos não conseguem ler blocos de pensamento do Fable 5.1 e editar turnos anteriores invalida blocos posteriores em contas criadas em ou após 31 de agosto de 2026.
O Fable 5.1 recusa requisições de cibersegurança?
Às vezes. A Anthropic relata aproximadamente 60% menos intervenções cibernéticas por sessão no Claude Code e permite identificar vulnerabilidades em códigos. O desenvolvimento de exploits continua sendo recusado.
Posso usar o Claude Fable 5.1 gratuitamente?
Não no plano Gratuito. O Pro usa créditos de uso, e o Max inclui modelos Fable para até 50% do limite semanal. A API não oferece nível gratuito além do crédito de inscrição.


Top comments (0)