Claude Fable 5.1 vs. Fable 5: quando migrar?
O Claude Fable 5.1 substituiu o Fable 5 em 1º de setembro de 2026, mantendo os mesmos US$ 10 e US$ 50 por milhão de tokens. A leitura de cache caiu de US$ 1 para US$ 0,25 por milhão, e os resultados melhoraram em todos os benchmarks publicados pela Anthropic. O Fable 5 continua disponível, com desativação prevista para não antes de 9 de junho de 2027, conforme a página do modelo Fable 5. Portanto, a decisão depende da sua carga de trabalho e de três mudanças de compatibilidade.
Esta comparação mostra o que permaneceu igual, o que melhorou, quais partes exigem ajustes e como decidir se vale a pena migrar. As principais fontes são a publicação de lançamento da Anthropic e O que há de novo no Claude Fable 5.1. Para a ficha técnica completa, consulte o que é o Claude Fable 5.1.
Comparação lado a lado
| Característica | Claude Fable 5.1 | Claude Fable 5 |
|---|---|---|
| ID do modelo | claude-fable-5-1 |
claude-fable-5 |
| Lançamento | 1º de setembro de 2026 | 9 de junho de 2026 (suspenso em 12 de junho e relançado em 1º de julho) |
| Desativação | Não antes de 1º de setembro de 2027 | Não antes de 9 de junho de 2027 |
| Contexto / saída máxima | 1M / 128K | 1M / 128K |
| Corte de conhecimento | Junho de 2026 | Janeiro de 2026 |
| Preço de entrada / saída | US$ 10 / US$ 50 | US$ 10 / US$ 50 |
| Leitura de cache | US$ 0,25 por milhão | US$ 1,00 por milhão |
| Gravações de cache | US$ 12,50 (5 min), US$ 20 (1 h) | O mesmo |
| Processamento em lote | US$ 5 / US$ 25 | O mesmo |
| Tokenizador | O mesmo, geração Opus 4.7 | O mesmo |
| Raciocínio | Adaptativo, sempre ativo | Adaptativo, sempre ativo |
tool_choice forçado |
any e tool retornam erro 400 |
Aceito |
| Blocos de raciocínio legíveis por modelos mais antigos | Não | Sim |
| Verificação de edição de histórico | Sim, obrigatória para contas criadas em ou após 31/08/2026 | Não |
| Nível de Prioridade | Não compatível | Compatível |
| Esforço por mensagem | Sim, beta | Não |
| Mensagens de sistema por turno | Sim, beta | Não |
thinking.display: "updates" |
Sim, beta | Sim, beta |
| Proveniência do conteúdo | Marca d’água de texto + C2PA na mídia | Marca d’água de texto |
| Retenção de dados | 30 dias obrigatório, Modelo Coberto | O mesmo |
| Categorias de recusa | As mesmas cinco | As mesmas cinco |
O que permaneceu igual
A compatibilidade é maior do que pode parecer. Permaneceram inalterados:
- a superfície da API;
- a janela de contexto de 1M;
- o limite de saída de 128K;
- os preços por token;
- o tokenizador;
- o mínimo de cache de 512 tokens;
- o raciocínio adaptativo sempre ativo;
- o padrão omitido para
thinking.display; - a proibição de pré-preenchimento;
- a proibição de parâmetros de amostragem;
- as mensagens de sistema no meio da conversa;
- as categorias de recusa;
- as mecânicas de fallback.
A Anthropic afirma que prompts existentes do Fable 5 devem funcionar bem no Fable 5.1 sem alterações.
Por isso, boa parte da documentação anterior continua válida, incluindo o guia de limites de taxa, o explicador de salvaguardas e o guia de disponibilidade na nuvem. Os dois modelos também compartilham o mesmo pool de limites de taxa.
O que melhorou
Benchmarks
Segundo os números publicados pela Anthropic, todas as linhas favoreceram o Fable 5.1:
| Benchmark | Fable 5.1 | Fable 5 | Delta |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | +27,9 |
| AutomationBench | 31,4% | 17,1% | +14,3 |
| Terminal-Bench 4.0 | 55,8% | 42,0% | +13,8 |
| GDPval-AA v2 | 1853 | 1723 | +130 Elo |
| OSWorld 2.0 (strict) | 41,7% | 36,1% | +5,6 |
| OSWorld 2.0 (partial) | 77,9% | 72,9% | +5,0 |
| Humanity’s Last Exam (sem ferramentas) | 60,9% | 57,8% | +3,1 |
| CursorBench 3.2.0 | 73,4% | 70,5% | +2,9 |
| Humanity’s Last Exam (com ferramentas) | 65,0% | 63,8% | +1,2 |
Os maiores saltos aparecem em agentes de longo prazo: pesquisa científica em terminal, automação de fluxos de trabalho e codificação agentiva. As diferenças são menores em tarefas de conhecimento e codificação no estilo IDE.
Esses resultados foram executados pelo fornecedor e ainda não contam com reprodução independente. Consulte o detalhamento dos benchmarks para ver a análise linha a linha.
Leituras de cache 75% mais baratas
De acordo com a página de preços, esta é a mudança financeira mais relevante para usuários do Fable 5.
Uma sessão de agente que relê um prefixo de 150.000 tokens a cada turno custava:
- Fable 5: US$ 0,15 por turno;
- Fable 5.1: US$ 0,0375 por turno.
A estimativa da Anthropic é de uma redução de 25% em cargas de trabalho típicas e de até 45% em cargas agentivas. O detalhamento dos preços reproduz os cálculos com três exemplos práticos.
Menos falsos positivos nas salvaguardas
A Anthropic relata que:
- os classificadores de biologia disparam 85% menos em solicitações benignas de biologia básica e medicina;
- as salvaguardas cibernéticas provocam cerca de 60% menos intervenções por sessão no Claude Code;
- o Fable 5.1 consegue identificar vulnerabilidades em código-fonte que o Fable 5 recusava.
O desenvolvimento de exploits continua sendo recusado. Mantenha os tratamentos existentes para recusas e fallbacks.
Mais margem para ajustar o esforço
A Anthropic afirma que o nível medium no Fable 5.1 oferece qualidade aproximadamente equivalente ao Fable 5 em um custo menor. Os ganhos sobre o Fable 5 são maiores em xhigh e max.
Na prática, uma carga do Fable 5 executada em high pode ser:
- movida para
mediumno Fable 5.1 para manter a qualidade usando menos tokens de saída; ou - mantida em
highpara buscar maior qualidade.
Valide essa hipótese em suas avaliações, em vez de assumir equivalência entre os níveis.
Corte de conhecimento mais recente
O corte passou de janeiro para junho de 2026: cinco meses adicionais de lançamentos de frameworks, mudanças de API e novos modelos que o Fable 5.1 conhece sem receber instruções extras.
Recursos adicionais para harnesses
O Fable 5.1 adiciona:
- alteração de esforço por mensagem sem resetar o cache;
- mensagens de sistema com escopo por turno para lembretes recorrentes;
- atualizações de progresso legíveis entre chamadas de ferramenta.
O Fable 5 já oferecia as atualizações de progresso. As outras duas capacidades são novas.
O que exige mais atenção
tool_choice forçado foi removido
No Fable 5.1, tool_choice: "any" e tool_choice: "tool" retornam erro 400.
A correção depende do motivo pelo qual você forçava a ferramenta:
- para garantir JSON, use
strict: truecomautoou saídas estruturadas; - para exigir uma chamada em um turno específico, adicione uma mensagem de sistema no meio da conversa indicando essa exigência.
É uma alteração pequena, mas precisa ser aplicada a cada local que usa chamadas de ferramenta forçadas.
Blocos de raciocínio funcionam em apenas uma direção
O Fable 5.1 consegue ler blocos de raciocínio produzidos pelo Fable 5. Assim, uma conversa pode continuar durante a migração mantendo o raciocínio anterior.
O Fable 5 não consegue ler blocos produzidos pelo Fable 5.1. Em uma transição gradual, se um roteador enviar a conversa de volta ao Fable 5, a API descarta esses blocos sem cobrança, e o Fable 5 replana o turno.
Verificação de edição do histórico
Os blocos de raciocínio do Fable 5.1 só são válidos na conversa exata que os produziu. Em contas criadas em ou após 31 de agosto de 2026, a próxima requisição falha se você:
- editar um turno anterior;
- reconstruir o prompt do sistema;
- alterar o array de ferramentas;
- injetar ou remover lembretes por turno;
- atualizar a data no prompt do sistema;
- compactar a conversa no cliente mantendo os turnos recentes literalmente.
O Fable 5 não fazia essa verificação. Se seu harness modifica messages, reserve tempo para uma auditoria. O guia de raciocínio preservado cobre a auditoria e as correções; o guia de migração traz a lista completa.
Nível de Prioridade
O Fable 5 suporta o Nível de Prioridade; o Fable 5.1 não. Se você depende de garantias empresariais de capacidade, mantenha o Fable 5 até que esse recurso seja adicionado.
Mudanças no loop de agente
Há três diferenças ajustáveis por [REDACTED PROMPT] O Fable 5.1 pode emitir uma chamada de ferramenta por turno quando o Fable 5 agrupava várias.
- Ele produz menos atualizações de progresso.
- Com esforço
low, responde mais frequentemente com base na memória em vez de pesquisar.
Cada comportamento tem uma correção de uma linha no guia de prompting, mas todos devem ser verificados durante a migração.
Regra de decisão por carga de trabalho
Migre agora
Considere migrar imediatamente se sua carga envolve:
- codificação agentiva de longa duração;
- pesquisa em múltiplas etapas;
- geração de documentos e planilhas.
É nesses cenários que os ganhos de benchmark se concentram, a economia de leitura de cache é mais significativa e a redução de falsos positivos das salvaguardas tem maior impacto.
A Cognition informou que moveria o tráfego do Devin para o Fable 5.1 no dia do lançamento, o sinal público mais claro dessa estratégia.
Migre depois da auditoria do harness
Faça a auditoria antes se seu código constrói o array messages por conta própria e modifica algo além de simplesmente anexar turnos.
Execute primeiro a verificação de edição do histórico em três etapas, corrija cada prefix_binding_mismatch e só então altere o modelo. A verificação é barata; descobrir o problema em produção não é.
Teste o nível medium
Se o Fable 5 em high já executava bem o trabalho rotineiro, teste medium no Fable 5.1 para buscar qualidade semelhante com menos tokens. Refaça a varredura de esforço em suas avaliações.
Permaneça no Fable 5
Mantenha o Fable 5 quando:
- o Nível de Prioridade for crítico;
- sua carga for intensiva em saída e tiver pouco prefixo em cache;
- a economia de leitura de cache for pequena diante do custo de migração.
A Anthropic se comprometeu a não desativar o Fable 5 antes de 9 de junho de 2027 em plataformas operadas por ela. Bedrock e Google Cloud definem suas próprias datas.
Avalie o Opus 5
Se o Fable 5 já era mais capacidade do que sua aplicação precisava, avalie o Opus 5. A orientação da Anthropic é começar com o Opus 5 e só migrar para um modelo superior quando ele não for suficiente. Consulte a comparação entre Fable 5.1 e Opus 5.
Teste os dois modelos no Apidog
A forma mais confiável de decidir é executar sua própria carga de trabalho lado a lado:
- Salve seus dez prompts de produção mais difíceis como requisições.
- Defina
modelcomo uma variável de ambiente. - Execute a coleção contra
claude-fable-5. - Execute novamente contra
claude-fable-5-1, usando o mesmo nível de esforço. - Compare, em cada requisição:
- o texto gerado;
-
usage.output_tokens; -
usage.cache_read_input_tokens.
- Adicione uma requisição com
tool_choiceforçado para detectar o erro 400 antes dos usuários.
Use o Apidog para configurar o teste. Você também pode baixar o Apidog e consultar o guia da API para ver os corpos das requisições.
FAQ
O Claude Fable 5.1 é um novo modelo ou uma atualização do Fable 5?
É um novo modelo, com o ID claude-fable-5-1 e uma data de desativação própria. Ele usa o mesmo tokenizador e os mesmos preços por token do Fable 5, mas foi treinado com dados até junho de 2026.
O Fable 5.1 custa mais que o Fable 5?
Não. Os preços de entrada e saída são os mesmos: US$ 10 e US$ 50 por milhão de tokens. As gravações de cache e as taxas de processamento em lote também são iguais. A leitura de cache caiu de US$ 1 para US$ 0,25 por milhão.
Meu código do Fable 5 funcionará no Fable 5.1?
Na maior parte dos casos, sim. Os principais pontos de atenção são:
-
tool_choice: "any"etool_choice: "tool"retornam erro 400; - editar o histórico entre requisições invalida blocos de raciocínio em contas criadas em ou após 31 de agosto de 2026.
O restante da superfície permanece igual.
O Fable 5 será desativado?
Ainda não. Em plataformas operadas pela Anthropic, o compromisso é não desativá-lo antes de 9 de junho de 2027. Bedrock e Google Cloud têm cronogramas próprios.
Qual modelo é melhor para codificação?
Segundo os números publicados pela Anthropic, o Fable 5.1 obteve:
- 55,8% contra 42,0% no Terminal-Bench 4.0;
- 73,4% contra 70,5% no CursorBench 3.2.0.
A diferença é grande em tarefas agentivas de terminal e menor em tarefas no estilo IDE. Ambos os resultados foram executados pelo fornecedor.
O Fable 5.1 recusa menos que o Fable 5?
A Anthropic relata 85% menos falsos positivos em biologia e cerca de 60% menos intervenções cibernéticas por sessão no Claude Code. As categorias de recusa continuam iguais, portanto mantenha seus tratamentos de recusa e fallback.


Top comments (0)