Claude Opus 5 é o modelo mais recente da linha Opus da Anthropic, lançado em 24 de julho de 2026. A Anthropic o posiciona para codificação agentic complexa e trabalho empresarial, e sua documentação o apresenta como ponto de partida padrão quando você não sabe qual modelo escolher. O preço base é de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída: a mesma taxa do Opus 4.8 e metade do preço do Fable 5.
Este guia reúne especificações, preço, benchmarks de lançamento, compatibilidade com o Opus 4.8, níveis de esforço e opções de implantação. Se você chama o modelo por HTTP, use o Apidog para enviar, salvar e inspecionar requisições enquanto valida a migração.
Claude Opus 5 em resumo
| Especificação | Valor |
|---|---|
| ID do modelo da API |
claude-opus-5 (sem sufixo de data) |
| Lançamento | 24 de julho de 2026 |
| Janela de contexto | 1.000.000 tokens, padrão e máximo |
| Saída máxima | 128.000 tokens na API de Mensagens; 300.000 na API de Lote com o cabeçalho beta output-300k-2026-03-24
|
| Preço base | US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de tokens de saída |
| Corte de conhecimento | Maio de 2026 |
| Pensamento adaptativo | Ativado por padrão |
| Níveis de esforço |
low, medium, high, xhigh, max; padrão high
|
| Nível de Prioridade | Não suportado |
| Disponibilidade | API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform no AWS, Google Cloud, Microsoft Foundry, GitHub Copilot |
Pontos práticos a considerar:
- Contexto de 1M tokens: é o padrão e também o máximo. Você não precisa enviar um cabeçalho beta e não há tarifa adicional para contexto longo.
- Conhecimento até maio de 2026: é mais recente que Fable 5 e Sonnet 5, ambos com corte em janeiro de 2026.
- Nível de Prioridade: Opus 4.8 suporta esse recurso; Opus 5 não. Se sua capacidade de produção depende dele, trate isso como bloqueador e revise o guia de migração.
Para os campos completos e atualizados, consulte a visão geral dos modelos da Anthropic.
O que é Claude Opus 5
Opus 5 é o sucessor do Claude Opus 4.8. Na API Claude, use o ID exato:
claude-opus-5
No Amazon Bedrock, o ID é:
anthropic.claude-opus-5
No Google Cloud, use novamente:
claude-opus-5
A Claude Platform no AWS usa um ID próprio.
A linha Opus é a categoria de maior capacidade geral da Anthropic, acima do Sonnet e abaixo dos modelos de pesquisa Fable e Mythos. A mudança relevante nesta geração é de posicionamento: em vez de ser apenas a opção premium para escalar, a Anthropic recomenda começar pelo Opus 5 quando não houver um modelo pré-selecionado.
O modelo também passa a ser o padrão para assinantes Max e o modelo de maior desempenho no Pro. Veja os caminhos gratuitos e pagos mais baratos para entender o impacto nos planos de consumo.
Preço e custo por token
| Taxa | Entrada por M tokens | Saída por M tokens |
|---|---|---|
| Padrão | US$ 5,00 | US$ 25,00 |
| API de Lote, 50% de desconto | US$ 2,50 | US$ 12,50 |
| Modo Rápido, prévia de pesquisa | US$ 10,00 | US$ 50,00 |
| Gravação em cache, TTL de 5 minutos | US$ 6,25 | n/a |
| Gravação em cache, TTL de 1 hora | US$ 10,00 | n/a |
| Acertos e atualizações de cache | US$ 0,50 | n/a |
O Claude Fable 5 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A Anthropic afirma que o Opus 5 fica a 0,5% do Fable 5 em codificação agentic, por metade do preço.
Para reduzir custos na implementação:
- Use cache de prompt quando houver contexto estável. O mínimo de cache caiu para 512 tokens, contra 1.024 no Opus 4.8.
- Reutilize acertos de cache. Eles custam US$ 0,50 por milhão de tokens, ou um décimo da entrada padrão.
- Envie trabalhos não urgentes para a API de Lote. A tarifa é reduzida pela metade.
- Avalie o Modo Rápido apenas para latência crítica. Ele dobra o preço para US$ 10 e US$ 50, em troca de aproximadamente 2,5x a velocidade de saída.
-
Evite
inference_geo: "us"sem necessidade. Essa configuração aplica multiplicador de 1,1x a entrada, saída, gravações e acertos de cache.
O Modo Rápido funciona somente na API própria da Anthropic. Ele não está disponível no Bedrock, Google Cloud, Microsoft Foundry ou API de Lote.
A análise completa de preços inclui exemplos por tarefa. As práticas para cortar sua conta da API Claude continuam aplicáveis. A referência oficial é a página de preços da Anthropic.
O que os benchmarks da Anthropic indicam
Os números abaixo foram publicados pela própria Anthropic no lançamento. Em 25 de julho de 2026, eles ainda não tinham reprodução independente. Use-os como alegações do fornecedor e valide seu próprio workload antes de migrar produção.
| Benchmark | Afirmação da Anthropic |
|---|---|
| Frontier-Bench v0.1 | Supera outros modelos e mais que dobra a pontuação do Opus 4.8, com menor custo por tarefa |
| ARC-AGI 3 | Aproximadamente 3x a pontuação do segundo melhor modelo |
| OSWorld 2.0, uso de computador | Supera o Fable 5 a um terço do custo |
| CursorBench 3.2, codificação agentic | Fica a 0,5% do pico do Fable 5 pela metade do preço |
| Zapier AutomationBench | Taxa de aprovação de aproximadamente 1,5x a do segundo melhor modelo |
| Química orgânica | +10,2 pontos sobre o Opus 4.8 |
| Análise de proteínas | +7,7 pontos sobre o Opus 4.8 |
Para tomar uma decisão de engenharia, priorize testes próprios em:
- tarefas agentic com ferramentas;
- edição e revisão de código no seu repositório;
- fluxos com uso de navegador ou computador;
- chamadas longas com contexto e cache;
- custo total por tarefa concluída, não apenas custo por token.
CursorBench e OSWorld são os resultados mais importantes para uma possível migração de Fable 5 para Opus 5, mas uma diferença de 0,5% pode desaparecer ou se inverter dependendo do seu prompt, base de código, ferramentas e critérios de sucesso.
O mergulho profundo nos benchmarks explica o que cada avaliação mede e como criar testes internos.
O limite honesto do Opus 5
Opus 5 não é o modelo mais capaz de toda a linha Claude.
Fable 5 mantém a designação de “modelo amplamente lançado mais capaz”. Em duas áreas específicas de pesquisa — exploração de cibersegurança e pesquisa autônoma em biologia — o Opus 5 ainda fica atrás do Mythos 5.
Na prática:
- para codificação agentic e automação empresarial, o Opus 5 é o principal candidato para avaliação;
- para exploração de segurança e pesquisa científica autônoma, avalie Mythos 5;
- para máxima capacidade geral, considere Fable 5.
Consulte o explicador do modelo de classe Mythos e Fable 5 vs Mythos 5.
Duas mudanças que quebram código do Opus 4.8
Trocar apenas o ID do modelo não é suficiente. Há duas mudanças que podem afetar a primeira requisição.
1. O pensamento é ativado por padrão
No Opus 4.8, omitir thinking executava a requisição sem pensamento. No Opus 5, a mesma requisição usa pensamento adaptativo.
Como max_tokens limita tanto tokens de pensamento quanto tokens visíveis de saída, uma configuração ajustada apenas para o tamanho esperado da resposta pode truncar silenciosamente.
Evite começar com valores muito baixos:
{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Refatore este handler e explique os trade-offs."
}
]
}
Monitore respostas incompletas e aumente max_tokens antes de assumir que o problema é do modelo.
2. Desativar pensamento é incompatível com xhigh e max
Esta combinação retorna HTTP 400:
{
"thinking": {
"type": "disabled"
},
"output_config": {
"effort": "xhigh"
}
}
O mesmo vale para effort: "max".
Se você tem uma configuração global que desativa pensamento e aumenta esforço, altere-a antes de migrar.
Outras mudanças de migração:
- os níveis de esforço foram recalibrados;
- o cabeçalho beta da janela de contexto foi removido;
- mensagens de sistema no meio da conversa agora são aceitas;
- o Nível de Prioridade não está disponível.
Use o guia de migração do Opus 4.8 para o Opus 5 para exemplos antes e depois. A referência oficial é o guia de migração da Anthropic. Se você ainda usa a geração anterior, consulte também o passo a passo da API do Opus 4.8.
Como usar output_config.effort
O parâmetro relevante para controlar custo e capacidade é:
{
"output_config": {
"effort": "high"
}
}
Os níveis disponíveis são:
low
medium
high
xhigh
max
O padrão é high.
O esforço controla quanto o modelo pensa antes de responder. Como os níveis foram recalibrados no Opus 5, não reutilize automaticamente as escolhas feitas para Opus 4.8.
Faça uma varredura simples:
- Escolha um conjunto fixo de tarefas representativas.
- Execute cada tarefa com
low,medium,highexhigh. - Registre sucesso, tokens, latência e custo.
- Use o menor nível que atinge o critério de qualidade.
- Reserve
xhighpara codificação e loops agentic quando a qualidade adicional justificar o custo.
low e medium são descritos como significativamente mais fortes do que nos modelos Opus anteriores. Para workloads de codificação e agentes, xhigh continua sendo o ponto de partida recomendado pela Anthropic.
Veja o guia do parâmetro de esforço para uma metodologia de avaliação e a interação com max_tokens.
Mudanças de comportamento e prompting
O guia de prompting da Anthropic para o Opus 5 documenta diferenças que afetam resultados mesmo quando o código permanece igual.
- Ele verifica o próprio trabalho sem ser solicitado. Remova instruções herdadas como “verifique sua resposta” se elas não forem necessárias.
- As respostas podem ser mais longas. Reduzir esforço diminui pensamento, não necessariamente o texto visível. Peça concisão explicitamente.
- Ele delega mais para subagentes. Delimite a delegação em workloads sensíveis a custo.
- Ele pode expandir o escopo da tarefa. Declare entregáveis, limites e critérios de conclusão no prompt.
Exemplo de prompt com escopo controlado:
Refatore apenas o handler `createUser`.
Restrições:
- Não altere a interface pública.
- Não crie novos arquivos.
- Preserve os testes existentes.
- Retorne apenas o diff e uma lista de até três trade-offs.
Com pensamento desativado, podem ocorrer dois artefatos: chamadas de ferramenta emitidas como texto simples e tags XML internas aparecendo na saída. Em loops agentic, esse texto pode contaminar a próxima interação.
A mitigação recomendada é manter pensamento ativado e reduzir custo usando um nível de esforço menor. Consulte o mergulho profundo em prompting e o guia Claude Code.
Onde executar o Opus 5
| Superfície | Status |
|---|---|
| API Claude | Disponível, ID claude-opus-5
|
| claude.ai | Disponível; padrão para Max, modelo principal para Pro |
| Claude Code | Disponível |
| Claude Cowork | Disponível |
| Amazon Bedrock | Disponível como anthropic.claude-opus-5
|
| Claude Platform no AWS | Disponível, ID próprio |
| Google Cloud | Disponível como claude-opus-5
|
| Microsoft Foundry | Disponível |
| GitHub Copilot | Disponível |
O Modo Rápido é a exceção: está disponível somente na API própria da Anthropic.
Testando requisições do Opus 5 no Apidog
Uma integração com Opus 5 envolve endpoint HTTP, autenticação, JSON, respostas em streaming e tratamento de erros. O Apidog ajuda a enviar a requisição, salvar exemplos em coleções, usar variáveis de ambiente e inspecionar a resposta campo a campo.
Configure seu ambiente desta forma:
- Armazene
ANTHROPIC_API_KEYcomo variável de ambiente. - Crie uma requisição base para a API de Mensagens.
- Duplique a requisição para testar
low,highexhighcom o mesmo prompt. - Ative streaming para observar onde respostas truncadas terminam.
- Inspecione o bloco
usagepara acompanhar tokens, cache e pensamento.
Requisição base:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Refactor this handler and explain the tradeoffs."
}
]
}'
Essa chamada usa pensamento adaptativo porque thinking não foi informado. Não reutilize valores baixos de max_tokens do Opus 4.8 sem testar: 1024 pode resultar em truncamento no Opus 5.
Para testar visualmente, baixe o Apidog e importe a requisição. O guia passo a passo da API cobre streaming, uso de ferramentas e leitura completa de usage.
Quem deve usar Claude Opus 5
Use Opus 5 quando:
- Você constrói agentes ou fluxos com muitas ferramentas. É o principal foco das alegações de benchmark da Anthropic.
- Você usa Fable 5 e precisa reduzir custos. A diferença alegada de 0,5% em codificação agentic merece uma avaliação no seu ambiente. Veja Opus 5 vs Fable 5.
- Você usa Opus 4.8 hoje. O preço é o mesmo, o corte de conhecimento é mais recente e a Anthropic relata resultados melhores; o custo principal é a migração.
- Você precisa de conhecimento recente. O corte em maio de 2026 está aproximadamente quatro meses à frente dos demais modelos Claude atuais.
Mantenha sua implementação atual quando:
- O Nível de Prioridade é essencial. Opus 4.8 mantém o recurso; Opus 5 não. Revise preços e níveis do Opus 4.8.
- Sua carga é simples, barata e de alto volume. Sonnet 5 pode ser suficiente. Veja Opus 5 vs Sonnet 5.
- Você faz exploração de cibersegurança ou pesquisa autônoma em biologia. Mythos 5 ainda lidera nessas áreas.
FAQ
Qual é o ID do modelo para Claude Opus 5?
Use claude-opus-5, sem sufixo de data. No Amazon Bedrock, use anthropic.claude-opus-5. No Google Cloud, use claude-opus-5.
Quanto custa o Claude Opus 5?
US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. A API de Lote reduz para US$ 2,50 e US$ 12,50. O Modo Rápido aumenta para US$ 10 e US$ 50.
Claude Opus 5 é melhor que Fable 5?
Segundo os números da Anthropic, ele fica próximo, mas não à frente. A empresa relata diferença de 0,5% no CursorBench 3.2 e vantagem no OSWorld 2.0 a um terço do custo. Fable 5 mantém a designação de modelo amplamente lançado mais capaz. Esses resultados ainda não tinham reprodução independente em 25 de julho de 2026.
Qual é a janela de contexto do Claude Opus 5?
A janela é de 1.000.000 tokens como padrão e máximo, sem cabeçalho beta nem custo adicional para contexto longo. A saída máxima é de 128.000 tokens na API de Mensagens ou 300.000 na API de Lote com output-300k-2026-03-24.
Preciso alterar meu código ao migrar do Opus 4.8?
Sim. Além do ID do modelo, revise max_tokens porque o pensamento é ativado por padrão. Também não combine thinking: {type: "disabled"} com esforço xhigh ou max, pois a API retorna HTTP 400. Refaça sua varredura de esforço.
Qual é o corte de conhecimento do Claude Opus 5?
Maio de 2026 para conhecimento confiável e dados de treinamento, o corte mais recente entre os modelos Claude atuais.

Top comments (0)