DEV Community

Cover image for Claude Opus 5 vs Fable 5: Vale a Pena Metade do Preço?
Lucas
Lucas

Posted on • Originally published at apidog.com

Claude Opus 5 vs Fable 5: Vale a Pena Metade do Preço?

A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026, e a pergunta que todas as equipes fizeram em uma hora foi a mesma: se o Opus 5 se aproxima do Fable 5 pela metade do preço, por que alguém continuaria pagando pelo Fable 5?

Experimente o Apidog hoje

Os números são simples. O Opus 5 custa US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. O Fable 5 custa US$ 10 e US$ 50: uma diferença exata de 2x em ambos os lados, sem letras miúdas sobre níveis ou mínimos. As próprias declarações de lançamento da Anthropic afirmam que o Opus 5 atinge 0,5% do pico do Fable 5 no CursorBench 3.2 e supera o Fable 5 no OSWorld 2.0 com um terço do custo.

Se você quiser fazer a comparação por conta própria, pode enviar o mesmo prompt para ambos os IDs de modelo a partir do Apidog e comparar as respostas e as contagens de tokens lado a lado.

Os dois modelos em um relance

Claude Opus 5 Claude Fable 5
ID do modelo de API claude-opus-5 claude-fable-5
Preço de entrada US$5 / MTok US$10 / MTok
Preço de saída US$25 / MTok US$50 / MTok
Janela de contexto 1M tokens (padrão e máximo) 1M tokens
Saída máxima 128k (300k em Lote com um cabeçalho beta) 128k
Corte de conhecimento Maio de 2026 Janeiro de 2026
Posicionamento Padrão recomendado pela Anthropic Modelo mais capaz amplamente lançado
Raciocínio Adaptativo, ativado por padrão, controlável via esforço Sempre ativo
Lançado 24 de julho de 2026 Início de junho de 2026

Duas linhas merecem uma segunda olhada antes de qualquer outra coisa.

A linha de corte contraria a história usual de “o nível mais novo é mais barato, o nível mais antigo é mais inteligente”. O Opus 5 tem conhecimento do mundo até maio de 2026. O Fable 5 para em janeiro de 2026, o mesmo corte que o Sonnet 5. Quatro meses de lançamentos de pacotes, versões de frameworks e alterações de API estão dentro dos dados de treinamento do Opus 5 e fora dos do Fable 5. Se o seu trabalho envolve bibliotecas de rápida evolução, o modelo mais barato é também o mais atualizado.

Comparação entre Claude Opus 5 e Claude Fable 5

A linha de posicionamento aponta para a direção oposta. A Anthropic ainda descreve o Fable 5 como seu modelo mais capaz amplamente lançado, e não transferiu essa designação para o Opus 5. O Opus 5 é o padrão recomendado, o que é uma afirmação diferente: é o que você deve buscar quando estiver em dúvida, não o que você deve buscar quando a tarefa está no limite do que qualquer modelo pode fazer.

Para a ficha técnica completa do modelo mais recente, consulte nosso explicador do Claude Opus 5. Para os detalhes de lançamento do Fable 5, consulte o que é o Claude Fable 5.

O que a Anthropic realmente afirma

Aqui estão as afirmações de lançamento que se referem a esta comparação, declaradas como a Anthropic as declara.

Benchmark Afirmação da Anthropic para o Opus 5
CursorBench 3.2 Dentro de 0,5% do pico do Fable 5, pela metade do preço
OSWorld 2.0 (uso de computador) Supera o Fable 5 com um terço do custo
Frontier-Bench v0.1 Supera todos os outros modelos; mais que o dobro da pontuação do Opus 4.8
ARC-AGI 3 Aproximadamente 3x o próximo melhor modelo
Zapier AutomationBench Taxa de aprovação aproximadamente 1,5x o próximo melhor modelo
Química orgânica +10,2 pontos acima do Opus 4.8
Análise de proteínas +7,7 pontos acima do Opus 4.8

Agora, a ressalva, porque é o ponto crucial. Cada um desses números é executado pelo fornecedor. A Anthropic projetou a configuração de avaliação, escolheu as configurações de esforço e publicou os resultados. Em 25 de julho de 2026, nenhum foi reproduzido independentemente. Isso não é uma acusação de má-fé; é o estado normal de um lançamento no segundo dia. Mas “dentro de 0,5% do Fable 5” descreve um conjunto de testes específico em uma configuração específica, e a diferença que você mede em suas próprias tarefas pode ser maior ou menor.

A afirmação sobre o OSWorld é a mais interessante dos dois números de comparação direta, porque é aquela em que o Opus 5 supera o Fable 5, em vez de apenas se aproximar. Tarefas de uso de computador recompensam persistência e recuperação em vez de profundidade de raciocínio bruta, o que se encaixa em um modelo ajustado para loops de agência. A afirmação sobre o CursorBench é mais suave: “dentro de 0,5% do pico do Fable 5” significa que o Fable 5 ainda detém o pico.

Nós detalhamos cada número, incluindo o que cada benchmark mede e não mede, na análise aprofundada dos benchmarks do Opus 5. Os próprios números de lançamento do Fable 5 estão na postagem sobre os benchmarks do Fable 5.

O argumento para o Opus 5

A diferença de preço é constante e se acumula. A US$5/US$25 contra US$10/US$50, uma carga de trabalho que custa US$3.000 por mês no Fable 5 custa US$1.500 no Opus 5 para um volume idêntico de tokens. Nenhum limite ou compromisso a reduz.

Os fatores de custo se somam à redução pela metade. A taxa da API em lote do Opus 5 é de US$2,50/US$12,50, um desconto adicional de 50%. Acertos e atualizações de cache custam US$0,50 por milhão, e o mínimo de cache de prompts caiu para 512 tokens (de 1.024 no Opus 4.8), então prompts de sistema curtos que antes eram muito pequenos para serem armazenados em cache agora são armazenados sem alteração de código.

A sobrecarga do prompt de sistema para uso de ferramentas também é menor: 286 tokens com tool_choice definido como auto ou none, contra 290 no Opus 4.8 e 675 no Opus 4.7. Juntos, estes fatores impactam significativamente a conta. Nosso detalhamento de preços do Opus 5 tem a tabela completa, e o guia sobre corte da sua conta da API do Claude aborda os fatores gerais.

Você pode gastar mais quando a tarefa merece. O parâmetro output_config.effort do Opus 5 assume high como padrão e os níveis foram recalibrados no lançamento, com low e medium significativamente mais fortes do que nos modelos Opus anteriores. Isso lhe dá um controle ajustável em vez de uma taxa fixa: classificação barata em low, codificação agêntica complexa em xhigh. O guia do parâmetro de esforço explica o ajuste a ser executado em vez de manter as configurações antigas.

É o modelo mais atualizado, por quatro meses.

É para onde os padrões estão indo. O Opus 5 é o novo padrão para assinantes Max e o modelo de maior desempenho disponível para usuários Pro, e ele está disponível na API do Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform na AWS, Google Cloud, Microsoft Foundry e GitHub Copilot. A visão geral dos modelos da Anthropic afirma claramente que, se você não tiver certeza de qual modelo usar, comece com o Opus 5.

O argumento para o Fable 5

Defender o modelo mais caro é um trabalho mais difícil, então sejamos específicos em vez de polidos.

A designação de capacidade não mudou. A Anthropic poderia ter coroado o Opus 5 como seu modelo mais capaz amplamente lançado no dia do lançamento. Ela não o fez. Quando um fornecedor mantém um superlativo em um modelo mais antigo e mais caro enquanto lança um mais barato do qual se orgulha muito, isso é um sinal sobre o topo da curva de capacidade, não uma falha de marketing.

Nos problemas mais difíceis, aqueles em que uma única execução falha custa mais do que um mês de gastos com API, o Fable 5 ainda é o modelo que a Anthropic aponta. Seu anúncio de lançamento é a referência para esse posicionamento.

O raciocínio sempre ativo remove um modo de falha. O Fable 5 “pensa” em cada requisição: a comparação de modelos da Anthropic lista seu raciocínio adaptativo como “sempre ativo”, e é o único modelo atual descrito dessa forma.

O Opus 5 permite desabilitar o raciocínio, e a própria orientação de prompt da Anthropic documenta o que acontece quando você faz isso: chamadas de ferramentas ocasionalmente são escritas como texto simples em vez de serem executadas — e esse texto vazado então “envenena” as etapas posteriores em um loop de agência — e tags XML internas às vezes aparecem na saída visível. A mitigação recomendada pela Anthropic é manter o raciocínio ativado e controlar o custo com menos esforço. Um modelo que nunca lhe oferece essa “armadilha” não pode ser vítima dela.

A flexibilidade do Opus 5 tem arestas afiadas. Combinar thinking: {type: "disabled"} com esforço xhigh ou max retorna um erro 400, aplicado por requisição. O raciocínio agora é executado por padrão quando você omite o campo thinking, então orçamentos de max_tokens dimensionados para uma carga de trabalho sem raciocínio podem ser truncados.

O Opus 5 também delega mais prontamente a subagentes e produz respostas padrão mais longas, ambos os quais aumentam silenciosamente o custo se você não os restringir. O Fable 5 não apresenta nenhuma dessas superfícies de migração. Se você fizer a mudança, nosso guia de migração do Opus 4.8 para o Opus 5 contém todas as mudanças que podem quebrar a compatibilidade.

Os custos de troca não são zero. Suas avaliações, prompts, configurações de esforço e modelo de custo são calibrados em relação ao modelo que você usa hoje. “Metade do preço” é uma declaração por token, não uma declaração de custo de projeto. Se a migração levar duas semanas para dois engenheiros e a carga de trabalho for pequena, a aritmética não funciona.

A comparação Fable 5 vs Opus 4.8 aborda o que o nível Fable oferece em relação ao nível Opus em geral, e a precificação do Fable 5 cobre sua estrutura de custo.

Como a diferença de preço se parece em requisições reais

Multiplicadores são fáceis de aceitar, mas difíceis de sentir o impacto. Aqui está uma tarefa de codificação agêntica: 200.000 tokens de entrada — um grande contexto de repositório mais um longo histórico de chamadas de ferramentas — e 20.000 tokens de saída.

Opus 5 Fable 5
Entrada (200k) US$1.00 US$2.00
Saída (20k) US$0.50 US$1.00
Por tarefa US$1.50 US$3.00
500 tarefas/mês US$750 US$1.500
5.000 tarefas/mês US$7.500 US$15.000

Com 500 tarefas por mês, a diferença é de US$750. Isso está dentro do ruído da maioria dos orçamentos de engenharia, e se o Fable 5 economizar uma execução falha por mês para sua equipe, ele se paga. Com 5.000 tarefas por mês, a diferença é de US$90.000 por ano, o que é uma conversa sobre pessoal.

Portanto, a regra de decisão é sobre volume, não sobre qual modelo é mais inteligente. Abaixo de algumas centenas de tarefas difíceis por mês, escolha com base na capacidade e ignore o preço. Acima de alguns milhares, você precisa de evidências de que o Fable 5 é melhor em sua carga de trabalho, não no conjunto de testes da Anthropic.

Mais uma conta: o modo rápido do Opus 5 — velocidade de saída 2,5x, uma prévia de pesquisa apenas na API própria — tem o preço de US$10/US$50, exatamente a taxa base do Fable 5. Se a latência for a restrição em vez da capacidade, você pode gastar o dinheiro do Fable 5 em um Opus 5 mais rápido em vez de um Fable 5 mais lento.

Observe que inference_geo: "us" adiciona um multiplicador de 1,1x em todas as categorias de tokens no Opus 5, alterando esses números em 10%.

Um framework de decisão por carga de trabalho

Sua carga de trabalho Escolha Por quê
Codificação agêntica, alto volume Opus 5 A Anthropic relata dentro de 0,5% no CursorBench pela metade do custo; o volume torna a diferença um dinheiro real
Uso de computador e automação de navegador Opus 5 O único benchmark onde a Anthropic afirma que o Opus 5 supera o Fable 5 diretamente
Trabalho com bibliotecas pós-janeiro de 2026 Opus 5 Corte de maio de 2026 versus janeiro de 2026
Tráfego de produção sensível ao custo Opus 5 Metade do preço, mais lote, mínimo de cache de 512 tokens e esforço low/medium
Execuções únicas de raciocínio de alto risco Fable 5 Ainda o modelo mais capaz amplamente lançado da Anthropic; o custo por execução é irrelevante em baixo volume
Sessões autônomas de longo prazo onde uma falha no meio da execução é cara Fable 5 Raciocínio sempre ativo, sem artefatos de raciocínio desativado, sem nova superfície de migração
Já estável no Fable 5, baixo volume Fable 5 O custo de migração excede as economias
Exploração de segurança cibernética ou pesquisa de biologia autônoma Nenhum dos dois, veja abaixo Ambos ficam aquém do Mythos 5 nessas áreas

O padrão: Opus 5 ganha em economia de throughput, Fable 5 ganha em risco de cauda. Se você executa muitas tarefas e pode tolerar um resultado ocasionalmente mais fraco, reduzir sua conta pela metade é a jogada óbvia. Se você executa poucas tarefas e um único resultado ruim é caro, a diferença de preço não é o que você deveria estar otimizando.

Executando a comparação em sua própria carga de trabalho

Os benchmarks do fornecedor mostram o que aconteceu nas tarefas de outra pessoa. O número que decide isso para você vem do seu próprio conjunto de avaliação, e obtê-lo leva uma tarde. Ambos os modelos estão por trás do mesmo endpoint de Mensagens, então a comparação é uma mudança de uma única string:

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "output_config": {"effort": "high"},
    "messages": [
      {"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Troque claude-opus-5 por claude-fable-5 e você terá o outro lado do teste. Uma configuração prática no Apidog se parece com isto:

  1. Armazene a chave da API como uma variável de ambiente para que ela nunca esteja no corpo da requisição, e crie um ambiente por modelo com o ID do modelo como uma variável.
  2. Salve a requisição em uma coleção e execute o mesmo cenário contra ambos os ambientes, de modo que a única coisa que mude seja a string do modelo.
  3. Leia os campos usage em cada resposta. Compare os tokens de entrada, saída e leitura de cache; é aí que a verdadeira diferença de custo aparece, já que o Opus 5 tende a respostas padrão mais longas.
  4. Inspecione o fluxo SSE e os payloads de chamadas de ferramentas ao comparar o comportamento agêntico. Se um modelo executou uma ferramenta ou escreveu a chamada como texto é visível no fluxo de eventos brutos.
  5. Repita a execução do Opus 5 com esforço low, medium, high e xhigh. A verdadeira questão geralmente não é “Opus 5 ou Fable 5”, mas “qual nível de esforço no Opus 5 corresponde à saída do Fable 5 pela qual estou pagando”.

O quinto passo é o que a maioria das equipes pula e o que decide o dinheiro. Baixe o Apidog para configurar os ambientes, ou siga o passo a passo completo da requisição em nosso guia da API do Opus 5. A página de preços da Anthropic tem as taxas autoritativas para ambos os modelos.

O teto honesto

Nenhum dos modelos nesta comparação está no topo da pilha da Anthropic.

O Fable 5 continua sendo o modelo mais capaz amplamente lançado pela própria designação da Anthropic, e o Opus 5 não recebeu essa designação. E acima de ambos, em dois eixos específicos de capacidade, encontra-se o Mythos 5: a Anthropic afirma que o Opus 5 ainda fica atrás do Mythos 5 em exploração de segurança cibernética e pesquisa autônoma em biologia.

O Mythos 5 é o modelo irmão sem classificador, lançado para o Fable 5 junto com um programa limitado em vez de para o público em geral, então não é uma opção para a maioria das equipes; nossa comparação Fable 5 vs Mythos 5 aborda a elegibilidade.

O resumo preciso do Opus 5 é, portanto, mais restrito do que as manchetes: capacidade de classe de fronteira pela metade do preço de fronteira, com um teto nomeado acima dele. É um produto forte. Não é “o melhor modelo agora custa a metade”, e qualquer um que lhe vender essa versão está pulando a parte em que a própria Anthropic manteve a coroa de capacidade no modelo mais caro.

FAQ

O Claude Opus 5 é melhor que o Fable 5?

Nos próprios benchmarks da Anthropic, o Opus 5 supera o Fable 5 em tarefas de uso de computador no OSWorld 2.0 e atinge 0,5% do pico do Fable 5 no CursorBench 3.2, ambos por uma fração do custo. Esses números são executados pelo fornecedor e não foram reproduzidos de forma independente até 25 de julho de 2026. A Anthropic ainda designa o Fable 5 como seu modelo mais capaz amplamente lançado, então nas tarefas mais difíceis o Fable 5 mantém a vantagem.

Quanto mais barato é o Opus 5 que o Fable 5?

Exatamente a metade em ambos os lados: US$5/US$25 por milhão de tokens de entrada/saída versus US$10/US$50. A taxa da API em lote do Opus 5 de US$2,50/US$12,50 amplia ainda mais a diferença para trabalhos não urgentes.

Qual modelo tem o corte de conhecimento mais recente?

O Opus 5, por quatro meses. Seu corte confiável é maio de 2026; o do Fable 5 é janeiro de 2026.

Devo migrar minha carga de trabalho do Fable 5 para o Opus 5?

Primeiro, analise os números de volume. Abaixo de algumas centenas de tarefas difíceis por mês, a economia raramente justifica o trabalho de migração. Acima de alguns milhares, a migração é claramente vantajosa, desde que seu próprio conjunto de avaliação confirme que a qualidade é mantida.

Qual é o ID do modelo para cada um?

claude-opus-5 e claude-fable-5, ambos sem sufixo de data. No Amazon Bedrock, o Opus 5 é anthropic.claude-opus-5.

Há algo que o Opus 5 suporte e o Fable 5 não?

O Opus 5 expõe o parâmetro output_config.effort com níveis recalibrados, aceita mensagens de sistema no meio da conversa, suporta o modo rápido a US$10/US$50 e armazena prompts tão curtos quanto 512 tokens em cache. Uma lacuna na direção oposta: o Nível Prioritário não é suportado no Opus 5, embora o Opus 4.8 o mantenha.

A resposta curta

Metade do preço vale a pena para a maioria das equipes, e a razão é o volume, e não a capacidade. Os números da Anthropic colocam o Opus 5 perto o suficiente em codificação agêntica e à frente no uso de computador, de modo que a economia de 2x se transforma em orçamento real com milhares de tarefas por mês. Adicione o corte mais recente de maio de 2026 e o controle de esforço, e a resposta padrão é o Opus 5.

Mantenha o Fable 5 quando a tarefa estiver no limite do que qualquer modelo pode fazer, quando uma única execução falha custar mais do que a diferença de preço, ou quando seu volume for baixo o suficiente para que o trabalho de migração supere a economia. E trate cada benchmark aqui como o que ele é: uma medição própria do fornecedor, em um ambiente de teste próprio do fornecedor, esperando que alguém a reproduza. Seu conjunto de avaliação é o desempate.

Top comments (0)