DEV Community

Cover image for O Que é Claude Opus 5? Especificações, Benchmarks e Preço
Lucas
Lucas

Posted on • Originally published at apidog.com

O Que é Claude Opus 5? Especificações, Benchmarks e Preço

Claude Opus 5 é o modelo mais recente da linha Opus da Anthropic, lançado em 24 de julho de 2026. A Anthropic o posiciona para codificação agentic complexa e trabalho empresarial, e sua documentação o apresenta como ponto de partida padrão quando você não sabe qual modelo escolher. O preço base é de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída: a mesma taxa do Opus 4.8 e metade do preço do Fable 5.

Experimente o Apidog hoje

Este guia reúne especificações, preço, benchmarks de lançamento, compatibilidade com o Opus 4.8, níveis de esforço e opções de implantação. Se você chama o modelo por HTTP, use o Apidog para enviar, salvar e inspecionar requisições enquanto valida a migração.

Claude Opus 5 em resumo

Especificação Valor
ID do modelo da API claude-opus-5 (sem sufixo de data)
Lançamento 24 de julho de 2026
Janela de contexto 1.000.000 tokens, padrão e máximo
Saída máxima 128.000 tokens na API de Mensagens; 300.000 na API de Lote com o cabeçalho beta output-300k-2026-03-24
Preço base US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de tokens de saída
Corte de conhecimento Maio de 2026
Pensamento adaptativo Ativado por padrão
Níveis de esforço low, medium, high, xhigh, max; padrão high
Nível de Prioridade Não suportado
Disponibilidade API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform no AWS, Google Cloud, Microsoft Foundry, GitHub Copilot

Pontos práticos a considerar:

  • Contexto de 1M tokens: é o padrão e também o máximo. Você não precisa enviar um cabeçalho beta e não há tarifa adicional para contexto longo.
  • Conhecimento até maio de 2026: é mais recente que Fable 5 e Sonnet 5, ambos com corte em janeiro de 2026.
  • Nível de Prioridade: Opus 4.8 suporta esse recurso; Opus 5 não. Se sua capacidade de produção depende dele, trate isso como bloqueador e revise o guia de migração.

Para os campos completos e atualizados, consulte a visão geral dos modelos da Anthropic.

O que é Claude Opus 5

Opus 5 é o sucessor do Claude Opus 4.8. Na API Claude, use o ID exato:

claude-opus-5
Enter fullscreen mode Exit fullscreen mode

No Amazon Bedrock, o ID é:

anthropic.claude-opus-5
Enter fullscreen mode Exit fullscreen mode

No Google Cloud, use novamente:

claude-opus-5
Enter fullscreen mode Exit fullscreen mode

A Claude Platform no AWS usa um ID próprio.

Claude Opus 5 comparado com outros modelos Claude.

A linha Opus é a categoria de maior capacidade geral da Anthropic, acima do Sonnet e abaixo dos modelos de pesquisa Fable e Mythos. A mudança relevante nesta geração é de posicionamento: em vez de ser apenas a opção premium para escalar, a Anthropic recomenda começar pelo Opus 5 quando não houver um modelo pré-selecionado.

O modelo também passa a ser o padrão para assinantes Max e o modelo de maior desempenho no Pro. Veja os caminhos gratuitos e pagos mais baratos para entender o impacto nos planos de consumo.

Preço e custo por token

Taxa Entrada por M tokens Saída por M tokens
Padrão US$ 5,00 US$ 25,00
API de Lote, 50% de desconto US$ 2,50 US$ 12,50
Modo Rápido, prévia de pesquisa US$ 10,00 US$ 50,00
Gravação em cache, TTL de 5 minutos US$ 6,25 n/a
Gravação em cache, TTL de 1 hora US$ 10,00 n/a
Acertos e atualizações de cache US$ 0,50 n/a

O Claude Fable 5 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A Anthropic afirma que o Opus 5 fica a 0,5% do Fable 5 em codificação agentic, por metade do preço.

Para reduzir custos na implementação:

  1. Use cache de prompt quando houver contexto estável. O mínimo de cache caiu para 512 tokens, contra 1.024 no Opus 4.8.
  2. Reutilize acertos de cache. Eles custam US$ 0,50 por milhão de tokens, ou um décimo da entrada padrão.
  3. Envie trabalhos não urgentes para a API de Lote. A tarifa é reduzida pela metade.
  4. Avalie o Modo Rápido apenas para latência crítica. Ele dobra o preço para US$ 10 e US$ 50, em troca de aproximadamente 2,5x a velocidade de saída.
  5. Evite inference_geo: "us" sem necessidade. Essa configuração aplica multiplicador de 1,1x a entrada, saída, gravações e acertos de cache.

O Modo Rápido funciona somente na API própria da Anthropic. Ele não está disponível no Bedrock, Google Cloud, Microsoft Foundry ou API de Lote.

A análise completa de preços inclui exemplos por tarefa. As práticas para cortar sua conta da API Claude continuam aplicáveis. A referência oficial é a página de preços da Anthropic.

O que os benchmarks da Anthropic indicam

Os números abaixo foram publicados pela própria Anthropic no lançamento. Em 25 de julho de 2026, eles ainda não tinham reprodução independente. Use-os como alegações do fornecedor e valide seu próprio workload antes de migrar produção.

Benchmark Afirmação da Anthropic
Frontier-Bench v0.1 Supera outros modelos e mais que dobra a pontuação do Opus 4.8, com menor custo por tarefa
ARC-AGI 3 Aproximadamente 3x a pontuação do segundo melhor modelo
OSWorld 2.0, uso de computador Supera o Fable 5 a um terço do custo
CursorBench 3.2, codificação agentic Fica a 0,5% do pico do Fable 5 pela metade do preço
Zapier AutomationBench Taxa de aprovação de aproximadamente 1,5x a do segundo melhor modelo
Química orgânica +10,2 pontos sobre o Opus 4.8
Análise de proteínas +7,7 pontos sobre o Opus 4.8

Para tomar uma decisão de engenharia, priorize testes próprios em:

  • tarefas agentic com ferramentas;
  • edição e revisão de código no seu repositório;
  • fluxos com uso de navegador ou computador;
  • chamadas longas com contexto e cache;
  • custo total por tarefa concluída, não apenas custo por token.

CursorBench e OSWorld são os resultados mais importantes para uma possível migração de Fable 5 para Opus 5, mas uma diferença de 0,5% pode desaparecer ou se inverter dependendo do seu prompt, base de código, ferramentas e critérios de sucesso.

O mergulho profundo nos benchmarks explica o que cada avaliação mede e como criar testes internos.

O limite honesto do Opus 5

Opus 5 não é o modelo mais capaz de toda a linha Claude.

Fable 5 mantém a designação de “modelo amplamente lançado mais capaz”. Em duas áreas específicas de pesquisa — exploração de cibersegurança e pesquisa autônoma em biologia — o Opus 5 ainda fica atrás do Mythos 5.

Na prática:

  • para codificação agentic e automação empresarial, o Opus 5 é o principal candidato para avaliação;
  • para exploração de segurança e pesquisa científica autônoma, avalie Mythos 5;
  • para máxima capacidade geral, considere Fable 5.

Consulte o explicador do modelo de classe Mythos e Fable 5 vs Mythos 5.

Duas mudanças que quebram código do Opus 4.8

Trocar apenas o ID do modelo não é suficiente. Há duas mudanças que podem afetar a primeira requisição.

1. O pensamento é ativado por padrão

No Opus 4.8, omitir thinking executava a requisição sem pensamento. No Opus 5, a mesma requisição usa pensamento adaptativo.

Como max_tokens limita tanto tokens de pensamento quanto tokens visíveis de saída, uma configuração ajustada apenas para o tamanho esperado da resposta pode truncar silenciosamente.

Evite começar com valores muito baixos:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "messages": [
    {
      "role": "user",
      "content": "Refatore este handler e explique os trade-offs."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Monitore respostas incompletas e aumente max_tokens antes de assumir que o problema é do modelo.

2. Desativar pensamento é incompatível com xhigh e max

Esta combinação retorna HTTP 400:

{
  "thinking": {
    "type": "disabled"
  },
  "output_config": {
    "effort": "xhigh"
  }
}
Enter fullscreen mode Exit fullscreen mode

O mesmo vale para effort: "max".

Se você tem uma configuração global que desativa pensamento e aumenta esforço, altere-a antes de migrar.

Outras mudanças de migração:

  • os níveis de esforço foram recalibrados;
  • o cabeçalho beta da janela de contexto foi removido;
  • mensagens de sistema no meio da conversa agora são aceitas;
  • o Nível de Prioridade não está disponível.

Use o guia de migração do Opus 4.8 para o Opus 5 para exemplos antes e depois. A referência oficial é o guia de migração da Anthropic. Se você ainda usa a geração anterior, consulte também o passo a passo da API do Opus 4.8.

Como usar output_config.effort

O parâmetro relevante para controlar custo e capacidade é:

{
  "output_config": {
    "effort": "high"
  }
}
Enter fullscreen mode Exit fullscreen mode

Os níveis disponíveis são:

low
medium
high
xhigh
max
Enter fullscreen mode Exit fullscreen mode

O padrão é high.

O esforço controla quanto o modelo pensa antes de responder. Como os níveis foram recalibrados no Opus 5, não reutilize automaticamente as escolhas feitas para Opus 4.8.

Faça uma varredura simples:

  1. Escolha um conjunto fixo de tarefas representativas.
  2. Execute cada tarefa com low, medium, high e xhigh.
  3. Registre sucesso, tokens, latência e custo.
  4. Use o menor nível que atinge o critério de qualidade.
  5. Reserve xhigh para codificação e loops agentic quando a qualidade adicional justificar o custo.

low e medium são descritos como significativamente mais fortes do que nos modelos Opus anteriores. Para workloads de codificação e agentes, xhigh continua sendo o ponto de partida recomendado pela Anthropic.

Veja o guia do parâmetro de esforço para uma metodologia de avaliação e a interação com max_tokens.

Mudanças de comportamento e prompting

O guia de prompting da Anthropic para o Opus 5 documenta diferenças que afetam resultados mesmo quando o código permanece igual.

  • Ele verifica o próprio trabalho sem ser solicitado. Remova instruções herdadas como “verifique sua resposta” se elas não forem necessárias.
  • As respostas podem ser mais longas. Reduzir esforço diminui pensamento, não necessariamente o texto visível. Peça concisão explicitamente.
  • Ele delega mais para subagentes. Delimite a delegação em workloads sensíveis a custo.
  • Ele pode expandir o escopo da tarefa. Declare entregáveis, limites e critérios de conclusão no prompt.

Exemplo de prompt com escopo controlado:

Refatore apenas o handler `createUser`.

Restrições:
- Não altere a interface pública.
- Não crie novos arquivos.
- Preserve os testes existentes.
- Retorne apenas o diff e uma lista de até três trade-offs.
Enter fullscreen mode Exit fullscreen mode

Com pensamento desativado, podem ocorrer dois artefatos: chamadas de ferramenta emitidas como texto simples e tags XML internas aparecendo na saída. Em loops agentic, esse texto pode contaminar a próxima interação.

A mitigação recomendada é manter pensamento ativado e reduzir custo usando um nível de esforço menor. Consulte o mergulho profundo em prompting e o guia Claude Code.

Onde executar o Opus 5

Superfície Status
API Claude Disponível, ID claude-opus-5
claude.ai Disponível; padrão para Max, modelo principal para Pro
Claude Code Disponível
Claude Cowork Disponível
Amazon Bedrock Disponível como anthropic.claude-opus-5
Claude Platform no AWS Disponível, ID próprio
Google Cloud Disponível como claude-opus-5
Microsoft Foundry Disponível
GitHub Copilot Disponível

O Modo Rápido é a exceção: está disponível somente na API própria da Anthropic.

Testando requisições do Opus 5 no Apidog

Uma integração com Opus 5 envolve endpoint HTTP, autenticação, JSON, respostas em streaming e tratamento de erros. O Apidog ajuda a enviar a requisição, salvar exemplos em coleções, usar variáveis de ambiente e inspecionar a resposta campo a campo.

Interface Apidog mostrando como testar chamadas do Claude Opus 5

Configure seu ambiente desta forma:

  1. Armazene ANTHROPIC_API_KEY como variável de ambiente.
  2. Crie uma requisição base para a API de Mensagens.
  3. Duplique a requisição para testar low, high e xhigh com o mesmo prompt.
  4. Ative streaming para observar onde respostas truncadas terminam.
  5. Inspecione o bloco usage para acompanhar tokens, cache e pensamento.

Requisição base:

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {
        "role": "user",
        "content": "Refactor this handler and explain the tradeoffs."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Essa chamada usa pensamento adaptativo porque thinking não foi informado. Não reutilize valores baixos de max_tokens do Opus 4.8 sem testar: 1024 pode resultar em truncamento no Opus 5.

Para testar visualmente, baixe o Apidog e importe a requisição. O guia passo a passo da API cobre streaming, uso de ferramentas e leitura completa de usage.

Quem deve usar Claude Opus 5

Use Opus 5 quando:

  • Você constrói agentes ou fluxos com muitas ferramentas. É o principal foco das alegações de benchmark da Anthropic.
  • Você usa Fable 5 e precisa reduzir custos. A diferença alegada de 0,5% em codificação agentic merece uma avaliação no seu ambiente. Veja Opus 5 vs Fable 5.
  • Você usa Opus 4.8 hoje. O preço é o mesmo, o corte de conhecimento é mais recente e a Anthropic relata resultados melhores; o custo principal é a migração.
  • Você precisa de conhecimento recente. O corte em maio de 2026 está aproximadamente quatro meses à frente dos demais modelos Claude atuais.

Mantenha sua implementação atual quando:

  • O Nível de Prioridade é essencial. Opus 4.8 mantém o recurso; Opus 5 não. Revise preços e níveis do Opus 4.8.
  • Sua carga é simples, barata e de alto volume. Sonnet 5 pode ser suficiente. Veja Opus 5 vs Sonnet 5.
  • Você faz exploração de cibersegurança ou pesquisa autônoma em biologia. Mythos 5 ainda lidera nessas áreas.

FAQ

Qual é o ID do modelo para Claude Opus 5?

Use claude-opus-5, sem sufixo de data. No Amazon Bedrock, use anthropic.claude-opus-5. No Google Cloud, use claude-opus-5.

Quanto custa o Claude Opus 5?

US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. A API de Lote reduz para US$ 2,50 e US$ 12,50. O Modo Rápido aumenta para US$ 10 e US$ 50.

Claude Opus 5 é melhor que Fable 5?

Segundo os números da Anthropic, ele fica próximo, mas não à frente. A empresa relata diferença de 0,5% no CursorBench 3.2 e vantagem no OSWorld 2.0 a um terço do custo. Fable 5 mantém a designação de modelo amplamente lançado mais capaz. Esses resultados ainda não tinham reprodução independente em 25 de julho de 2026.

Qual é a janela de contexto do Claude Opus 5?

A janela é de 1.000.000 tokens como padrão e máximo, sem cabeçalho beta nem custo adicional para contexto longo. A saída máxima é de 128.000 tokens na API de Mensagens ou 300.000 na API de Lote com output-300k-2026-03-24.

Preciso alterar meu código ao migrar do Opus 4.8?

Sim. Além do ID do modelo, revise max_tokens porque o pensamento é ativado por padrão. Também não combine thinking: {type: "disabled"} com esforço xhigh ou max, pois a API retorna HTTP 400. Refaça sua varredura de esforço.

Qual é o corte de conhecimento do Claude Opus 5?

Maio de 2026 para conhecimento confiável e dados de treinamento, o corte mais recente entre os modelos Claude atuais.

Top comments (0)