Claude Fable 5.1 vs. Claude Opus 5: quando vale a pena trocar?
O Claude Fable 5.1 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. O Claude Opus 5 custa US$ 5 e US$ 25, respectivamente. A própria Anthropic recomenda começar pelo Opus 5 e migrar para o Fable 5.1 apenas quando as avaliações com o Opus 5 em maior esforço continuarem abaixo do esperado. Esta comparação transforma essa recomendação em uma regra prática: analisar benchmarks, custos de cache e limitações de integração.
As fontes são o post de lançamento da Anthropic, a página do modelo Fable 5.1 e a página de preços.
Para uma visão geral, consulte também:
Comparação lado a lado
| Característica | Claude Fable 5.1 | Claude Opus 5 |
|---|---|---|
| ID do modelo | claude-fable-5-1 |
claude-opus-5 |
| Lançamento | 1º de setembro de 2026 | 24 de julho de 2026 |
| Posicionamento | Raciocínio exigente e agentes de longo prazo | Codificação agentica complexa e trabalho empresarial; padrão recomendado |
| Entrada / saída | US$ 10 / US$ 50 | US$ 5 / US$ 25 |
| Leitura de cache | US$ 0,25 | US$ 0,50 |
| Escrita de cache, 5 min / 1 h | US$ 12,50 / US$ 20 | US$ 6,25 / US$ 10 |
| Lote | US$ 5 / US$ 25 | US$ 2,50 / US$ 12,50 |
| Modo rápido | Não | Sim, US$ 10 / US$ 50 |
| Nível de prioridade | Não | Não |
| Contexto / saída máxima | 1M / 128K | 1M / 128K; 300K em lote com beta |
| Data limite de conhecimento | Junho de 2026 | Maio de 2026 |
| Latência comparativa | Mais lenta | Moderada |
| Pensamento | Sempre ativo; disabled retorna 400 |
Ativo por padrão; disabled permitido em high ou abaixo |
tool_choice forçado |
Retorna 400 | Aceito |
| Classificadores de segurança | Ciber, bio, LLM de fronteira, extração de raciocínio e danos gerais | Apenas ciber |
| Retenção zero de dados | Não disponível, salvo autorização | Disponível |
| Esforço por mensagem, beta | Sim | Sim |
| Verificação de edição do histórico | Sim | Não |
O que os benchmarks mostram
Todos os números abaixo foram publicados pela Anthropic e executados pela própria empresa. Ainda não há reprodução independente.
| Benchmark | Fable 5.1 | Opus 5 | Diferença |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 29,0% | +23,6 |
| AutomationBench | 31,4% | 26,9% | +4,5 |
| Último Exame da Humanidade, sem ferramentas | 60,9% | 56,6% | +4,3 |
| Terminal-Bench 4.0 | 55,8% | 52,3% | +3,5 |
| CursorBench 3.2.0 | 73,4% | 70,0% | +3,4 |
| OSWorld 2.0, parcial | 77,9% | 75,4% | +2,5 |
| OSWorld 2.0, estrito | 41,7% | 39,6% | +2,1 |
| Último Exame da Humanidade, com ferramentas | 65,0% | 63,6% | +1,4 |
| GDPval-AA v2 | 1853 | 1824 | +29 Elo |
Há duas histórias nessa tabela:
- No Terminal-Bench-Science, o Fable 5.1 quase dobra a pontuação do Opus 5. Esse benchmark simula pesquisa de longo prazo e uso intensivo de ferramentas, com experimentos executados em um terminal durante bastante tempo.
- Nos demais testes, a diferença fica entre um e cinco pontos. Os 4,5 pontos no AutomationBench são relevantes. Já 1,4 ponto no Último Exame da Humanidade com ferramentas ou 29 Elo no GDPval podem ser menores do que o impacto do prompt e do nível de esforço.
Também é importante observar a evolução do Terminal-Bench. O Opus 5 foi lançado em julho com 52,3% no Terminal-Bench 4.0, à frente dos 42,0% do Fable 5. O Fable 5.1 retomou a liderança com 55,8%, mas por uma margem de 3,5 pontos, não de 13,8. A vantagem do Fable em codificação agentica é real, porém mais estreita do que era anteriormente.
Para uma comparação histórica, veja Claude Opus 5 vs. Claude Fable 5.
A matemática de preços não é simplesmente 2x
Sem cache, o Fable 5.1 custa exatamente o dobro do Opus 5 em todas as categorias. As leituras de cache mudam o cálculo:
- Fable 5.1: US$ 0,25
- Opus 5: US$ 0,50
Portanto, o multiplicador efetivo depende da proporção do input que pode ser reutilizada como prefixo em cache.
Exemplo 1: agente com prefixo em cache
Considere uma rodada com:
- 150.000 tokens em cache
- 1.000 tokens de entrada sem cache
- 800 tokens de saída
Opus 5:
5(0.001) + 0.5(0.15) + 25(0.0008)
= $0.005 + $0.075 + $0.02
= $0.10
Fable 5.1:
10(0.001) + 0.25(0.15) + 50(0.0008)
= $0.01 + $0.0375 + $0.04
= $0.0875
Neste cenário, o Fable 5.1 é mais barato por rodada.
Exemplo 2: revisão com muita entrada sem cache
Agora considere:
- 30.000 tokens de entrada sem cache
- 4.000 tokens de saída
Opus 5:
$0.15 + $0.10 = $0.25
Fable 5.1:
$0.30 + $0.20 = $0.50
Aqui, o Fable 5.1 custa exatamente o dobro.
O ponto de virada
O custo por rodada do Fable 5.1 fica abaixo do Opus 5 quando:
tokens de entrada em cache >
20 × tokens de entrada sem cache
+ 5 × tokens de saída
Essa condição é comum em loops de agentes que reutilizam prefixos longos. Ela não costuma aparecer em tarefas dominadas por geração de saída.
As gravações de cache também custam o dobro no Fable 5.1. Se a sessão redefine o cache com frequência, a vantagem desaparece.
Consulte o detalhamento de preços do Fable 5.1 e o detalhamento de preços do Opus 5.
Onde o Opus 5 vence
Pensamento desativado
O Opus 5 aceita:
{"type": "disabled"}
Isso é permitido no nível de esforço high ou abaixo. O Fable 5.1 nunca aceita pensamento desativado.
Para classificação, extração e rotas de resposta curta, o Opus 5 em low ou com pensamento desativado tende a ser mais barato e mais rápido.
Modo rápido
O Opus 5 oferece um modo rápido em pré-visualização de pesquisa, com velocidade de saída de até 2,5x por US$ 10 de entrada e US$ 50 de saída. O Fable 5.1 não possui equivalente.
Se a latência for mais importante do que os últimos pontos de benchmark, essa diferença pesa bastante.
Latência
A Anthropic classifica o Fable 5.1 como “mais lento” e o Opus 5 como “moderado”. Turnos únicos do Fable 5.1 em tarefas difíceis e com alto esforço podem levar vários minutos.
Retenção zero de dados
O Opus 5 está disponível sob ZDR. O Fable 5.1 é um Modelo Coberto e retorna 400, a menos que a Anthropic autorize expressamente o acesso com retenção zero de dados.
Menos recusas em algumas cargas de trabalho
O Opus 5 executa apenas classificadores de cibersegurança. O Fable 5.1 executa o conjunto completo do Fable:
- Cibersegurança
- Bio
- Desenvolvimento de LLM de fronteira
- Extração de raciocínio
- Danos gerais
Uma carga benigna de ciências da vida ou de machine learning que não acione o Opus 5 pode acionar o Fable 5.1. Nesse caso, o Opus 5 é um dos alvos de fallback permitidos.
Uso forçado de ferramentas
O Opus 5 aceita tool_choice: any e tool. O Fable 5.1 retorna 400. Integrações que dependem de chamadas forçadas podem continuar usando o Opus 5 sem reescrita.
Edição do histórico
O Opus 5 não invalida o pensamento quando turnos anteriores são editados. O Fable 5.1 invalida blocos de pensamento posteriores após uma edição.
Sistemas que compactam o histórico no cliente ou injetam lembretes por turno precisam ser auditados antes da migração para o Fable 5.1.
Onde o Fable 5.1 vence
Pesquisa de longo prazo e agentes de terminal
O resultado de 52,6% contra 29,0% no Terminal-Bench-Science é a maior diferença da tabela da Anthropic. Se os agentes executam experimentos, fazem pesquisas web em várias etapas ou operam por horas, essa é a carga de trabalho para a qual o Fable 5.1 foi construído.
Automação de fluxo de trabalho empresarial
A diferença de 31,4% contra 26,9% no AutomationBench é relevante para tarefas de ponta a ponta em aplicativos empresariais.
Agentes com prefixos armazenados em cache
Como a leitura de cache custa US$ 0,25, o Fable 5.1 pode acabar sendo mais barato por rodada em loops dominados por prefixos longos.
Data limite de conhecimento
O Fable 5.1 tem conhecimento até junho de 2026, enquanto o Opus 5 vai até maio de 2026. É apenas um mês de diferença, mas o Fable 5.1 é o modelo Claude mais recente.
Visão em documentos densos
A Anthropic destaca melhorias na leitura de gráficos, registros e tabelas aninhadas em PDFs, especialmente com ferramentas de recorte e zoom. Como não há um benchmark de visão publicado comparando os dois modelos, trate essa afirmação como uma hipótese para testar.
Quando o Opus 5 em xhigh falhar
Esta é a regra da Anthropic:
Comece com o Opus 5. Se uma tarefa falhar na sua avaliação com o Opus 5 em
xhigh, tente o Fable 5.1 emhigh.
Faça a migração por rota ou tarefa, não globalmente.
O nível de esforço muda a comparação
Ambos os modelos expõem cinco níveis de esforço. Para o Fable 5.1, a Anthropic afirma que o nível low é frequentemente competitivo com modelos Claude Opus e Claude Sonnet em custo por tarefa, enquanto alcança pontuações mais altas.
Isso muda a comparação para tarefas rotineiras. Em vez de comparar apenas:
Opus 5 em high vs. Fable 5.1 em high
teste também:
Opus 5 em high vs. Fable 5.1 em low ou medium
Níveis menores de esforço normalmente geram menos tokens de saída, compensando parte do preço de US$ 10 por milhão de tokens.
O inverso também importa: os ganhos do Fable 5.1 sobre o Fable 5 aumentam em xhigh e max. O teto de capacidade acima do Opus 5 aparece justamente nos níveis que também exigem mais tempo.
Teste os dois modelos em vários níveis de esforço antes de tirar conclusões dos números de lançamento. O guia de esforço do Opus 5 cobre os cinco níveis; a semântica é a mesma no Fable 5.1.
Framework de decisão
-
Comece com o Opus 5 em
high. É a recomendação padrão da Anthropic, custa metade e oferece menos classificadores de segurança e suporte a ZDR. -
Aumente para
xhighnas tarefas que falharem. Isso pode resolver o problema sem trocar de modelo. -
Migre para o Fable 5.1 em
highapenas as tarefas que continuarem falhando. Mantenha o Opus 5 nas rotas que já funcionam. - Meça o perfil de cache. Em loops pesados em prefixos, o Fable 5.1 pode custar menos por rodada.
-
Audite a integração antes da migração. Verifique
tool_choiceforçado, edição do histórico, ZDR e tratamento de erros 400. -
Compare os níveis de esforço. Fable 5.1 em
lowoumediumpode oferecer uma relação custo-desempenho diferente da comparação emhigh.
O guia de migração do Fable 5.1 inclui uma lista de verificação para essa auditoria.
Como executar a comparação no Apidog
Use uma coleção com prompts reais de produção e defina o modelo como variável de ambiente.
Execute a mesma coleção em quatro configurações:
-
claude-opus-5emhigh -
claude-opus-5emxhigh -
claude-fable-5-1emhigh -
claude-fable-5-1emlow
Para cada execução, registre:
- A resposta
usage.output_tokensusage.cache_read_input_tokens- O nível de esforço
- O tempo de resposta
- Erros ou recusas
Depois, calcule o custo por tarefa com um script pós-resposta usando as taxas de cada modelo. O histórico de execuções do Apidog permite repetir a comparação quando um novo modelo for lançado.
Use o Apidog para criar a coleção, executar os testes e comparar os resultados. Também é possível baixar o Apidog.
FAQ
O Claude Fable 5.1 é melhor que o Opus 5?
Nos benchmarks publicados pela Anthropic, sim: as margens variam de 1,4 a 23,6 pontos. A maior diferença está no Terminal-Bench-Science; na maioria dos demais testes, ela fica abaixo de cinco pontos. Esses resultados foram executados pelo próprio fornecedor.
O Fable 5.1 vale o dobro do preço?
Para pesquisa de longo prazo, agentes de terminal, automação empresarial e loops com prefixos pesados, muitas vezes pode valer a pena. Leituras de cache mais baratas podem reduzir o custo por turno.
Para tarefas com muita saída, sensíveis à latência ou focadas em classificação, o Opus 5 tende a ser mais adequado em custo e velocidade. A regra da Anthropic continua sendo: só migre quando o Opus 5 em maior esforço falhar nas suas próprias avaliações.
Qual é mais rápido?
O Opus 5. A Anthropic o classifica com latência “moderada”, contra “mais lenta” para o Fable 5.1. Além disso, o Opus 5 oferece modo rápido com velocidade de saída de até 2,5x.
Os dois modelos usam os mesmos classificadores de segurança?
Não. O Opus 5 executa apenas classificadores de cibersegurança. O Fable 5.1 também inclui classificadores de bio, LLM de fronteira, extração de raciocínio e danos gerais.
Posso usar o Fable 5.1 com retenção zero de dados?
Não. O Fable 5.1 requer retenção de 30 dias e é um Modelo Coberto. O Opus 5 está disponível sob ZDR.
Uma conversa pode alternar entre os dois modelos?
Sim, com algumas diferenças:
- Ao migrar para cima, o Fable 5.1 lê os blocos de pensamento do Opus 5.
- Ao voltar para o Opus 5, a API descarta os blocos de pensamento do Fable 5.1 antes de enviá-los ao Opus 5.
- Esse descarte não gera cobrança, e o Opus 5 replana o turno.

Top comments (0)