A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026 e o Claude Sonnet 5 em 30 de junho de 2026. Ambos são modelos de geração atual, com janela de contexto de 1M de tokens, saída máxima de 128k, pensamento adaptativo ativado por padrão e um parâmetro de esforço. À primeira vista, parecem o mesmo modelo em faixas de preço diferentes — mas a escolha deve considerar custo por tarefa concluída, retentativas e requisitos de qualidade.
A decisão também depende da data. O Sonnet 5 mantém a taxa introdutória de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída até 31 de agosto de 2026. Em 1º de setembro de 2026, passa para US$ 3 / US$ 15. O Opus 5 custa US$ 5 / US$ 25 e não tem alteração prevista. Portanto, o Opus custa 2,5x mais hoje, mas cerca de 1,67x mais após setembro. Se sua carga entra em produção no quarto trimestre, faça o orçamento com a tarifa de setembro.
Este guia mostra como comparar os dois modelos por especificações, custo por tarefa, uso em agentes de código e automação. Para validar a decisão com seus próprios prompts, execute ambos lado a lado no Apidog e compare os campos usage retornados pela API.
Preços e a mudança de setembro
Estas são as tarifas publicadas na página de preços da Anthropic:
| Modelo | Entrada / MTok | Saída / MTok | Status |
|---|---|---|---|
| Claude Opus 5 | US$ 5,00 | US$ 25,00 | Padrão |
| Claude Sonnet 5, até 31 de agosto de 2026 | US$ 2,00 | US$ 10,00 | Introdutório |
| Claude Sonnet 5, a partir de 1º de setembro de 2026 | US$ 3,00 | US$ 15,00 | Padrão |
Antes de modelar custos do Opus 5, considere também:
- Cache de prompt: US$ 6,25 por MTok para gravação de 5 minutos, US$ 10 para gravação de 1 hora e US$ 0,50 para acertos de cache.
- API de Lote: US$ 2,50 / US$ 12,50, com desconto fixo de 50%.
- Modo rápido: US$ 10 / US$ 50 para 2,5x de velocidade de saída. É uma prévia de pesquisa, disponível apenas na API de primeira parte e não pode ser combinado com lote.
-
inference_geo: "us": multiplicador de 1,1x para cada categoria de token.
Veja os detalhes nos guias de preços do Opus 5 e preços do Sonnet 5.
Um ponto importante: o Opus 5 custa o mesmo que o Opus 4.8. A Anthropic não elevou o preço do nível Opus para essa geração.
Especificações: quase o mesmo invólucro
| Especificação | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| ID do modelo | claude-opus-5 |
claude-sonnet-5 |
| Janela de contexto | 1M tokens | 1M tokens |
| Saída máxima | 128k; 300k na API de Lote com cabeçalho beta | 128k |
| Pensamento adaptativo | Ativado por padrão | Ativado por padrão |
| Níveis de esforço | Cinco, até max; padrão high
|
low, medium, high, xhigh
|
| Corte de conhecimento | Maio de 2026 | Janeiro de 2026 |
| Nível de Prioridade | Não suportado | Não disponível |
| Cache, ferramentas, lote e visão | Suportado | Suportado |
| Tokenizador | Geração 4.7 | Geração 4.7 |
Três diferenças têm impacto prático:
Corte de conhecimento: o Opus 5 inclui conhecimento até maio de 2026; o Sonnet 5 para em janeiro de 2026. Para dependências, APIs ou mudanças recentes, o Opus pode responder melhor sem recuperação. Com RAG bem implementado, essa diferença pode diminuir.
Nível de Prioridade: nenhum dos dois oferece esse recurso. Equipes migrando do Opus 4.8 devem revisar requisitos de latência. Consulte o guia de migração do Opus 4.8 para o Opus 5.
Tokenizador: não há diferença entre Opus 5 e Sonnet 5. Ambos usam o tokenizador de geração 4.7.
Por que custo por token não é custo por tarefa
A Anthropic documenta que modelos Claude 4.7 e posteriores podem produzir aproximadamente 30% mais tokens para o mesmo texto em comparação com Sonnet 4.6 e anteriores. Isso não é uma diferença entre Opus 5 e Sonnet 5: ambos tokenizam a mesma entrada da mesma forma.
Na prática, o custo depende principalmente de:
- volume de saída;
- uso de cache;
- número de chamadas de ferramentas;
- taxa de retentativas;
- tempo de revisão humana;
- validações automáticas e falhas de execução.
O Opus 5 pode gerar respostas visíveis mais longas. Reduzir output_config.effort reduz o pensamento, mas não garante respostas mais curtas. Se a resposta está verbosa, corrija o prompt.
Exemplo de instrução de concisão:
Responda apenas com:
1. o diagnóstico;
2. os arquivos que precisam mudar;
3. um diff mínimo;
4. riscos ou testes necessários.
Não explique conceitos básicos. Limite a resposta a 300 palavras.
O guia de prompting do Opus 5 mostra mais estratégias para controlar a saída.
Use o endpoint de contagem de tokens para medir entradas reais antes de projetar custos.
Exemplo de custo diário
Considere 500k tokens de entrada e 40k tokens de saída por dia:
| Cenário | Custo diário | Relação com Sonnet 5 |
|---|---|---|
| Opus 5 | US$ 3,50 | Base |
| Sonnet 5 introdutório, US$ 2 / US$ 10 | US$ 1,40 | Opus é 2,5x |
| Sonnet 5 padrão, US$ 3 / US$ 15 | US$ 2,10 | Opus é 1,67x |
| Opus 5 com 30% mais saída | US$ 3,80 | Opus é 1,81x |
A parte decisiva é a retentativa. Com preços padrão:
- uma execução do Opus 5: US$ 3,50;
- uma execução do Sonnet 5: US$ 2,10;
- duas execuções do Sonnet 5: US$ 4,20.
Se o Sonnet precisa repetir uma tarefa que o Opus conclui na primeira tentativa, ele pode se tornar a opção mais cara. Avalie custo por resultado válido, não apenas custo por chamada. Para reduzir despesas em ambos, consulte o guia para reduzir sua conta da API Claude.
Quando o Opus 5 justifica o preço
Os números de lançamento da Anthropic devem ser tratados como resultados publicados pelo fornecedor, não como medições independentes. Até 25 de julho de 2026, esses resultados não haviam sido reproduzidos de forma independente.
As alegações de lançamento incluem:
- Frontier-Bench v0.1: Opus 5 supera outros modelos e mais que dobra a pontuação do Opus 4.8, com menor custo por tarefa.
- ARC-AGI 3: aproximadamente 3x a pontuação do segundo melhor modelo.
- OSWorld 2.0: supera o Fable 5 a cerca de um terço do custo.
- CursorBench 3.2: fica a 0,5% do pico do Fable 5 pela metade do preço.
- Zapier AutomationBench: taxa de aprovação cerca de 1,5x maior que o segundo melhor modelo.
- Ciência: ganhos de 10,2 pontos em química orgânica e 7,7 em análise de proteínas versus Opus 4.8.
O Sonnet 5 ficou abaixo do Opus 4.8 nos números de lançamento: SWE-bench Pro de 63,2% contra 69,2%, Terminal-Bench 2.1 de 80,4% contra 82,7% e OSWorld-Verified de 81,2% contra 83,4%.
Veja atribuições e ressalvas nos posts de benchmarks do Opus 5 e benchmarks do Sonnet 5.
Prefira o Opus 5 quando houver uma ou mais destas condições:
- Agentes de código de longa duração: refatorações multi-arquivo, migrações e fluxos com dezenas de chamadas de ferramentas.
- Alto custo de erro: alterações em produção, segurança, infraestrutura ou código que exige revisão humana profunda.
- Uso de computador e automação de desktop: é o principal cenário destacado pela Anthropic com OSWorld 2.0.
- Raciocínio científico ou analítico complexo.
- Necessidade de conhecimento até maio de 2026 sem uma camada de recuperação confiável.
Quando o Sonnet 5 é suficiente
Para a maior parte do tráfego de produção, o Sonnet 5 é a escolha prática. Pagar por capacidade que não muda seus critérios de aceitação não melhora o sistema.
Use o Sonnet 5 quando:
- O volume é alto e cada chamada é curta: classificação, extração, sumarização, tagging e roteamento.
- A saída possui validação automática: schemas, testes, parsers e regras de negócio detectam falhas com baixo custo.
- Latência importa mais que profundidade.
- Você está prototipando: comece com Sonnet e faça upgrade somente se os dados justificarem.
O Sonnet 5 é o modelo padrão do plano Claude gratuito, permitindo validar prompts reais antes de integrar a API. O Opus 5 está disponível para assinantes Pro e é o padrão para Max. Veja os caminhos no guia de acesso gratuito ao Opus 5.
Tabela de decisão por carga de trabalho
| Carga de trabalho | Escolha | Motivo |
|---|---|---|
| Refatoração multi-arquivo ou migração em loop de agente | Opus 5 | Falhas compostas tornam a confiabilidade por etapa mais importante |
| Classificação ou extração de alto volume | Sonnet 5 | Ambos tendem a atingir o teto de qualidade; preço vence |
| Chat para clientes com RAG | Sonnet 5 | Recuperação reduz a diferença de conhecimento; latência importa |
| Uso de computador ou automação de desktop | Opus 5 | OSWorld 2.0 é a alegação de agente mais forte da Anthropic |
| Processamento noturno de documentos | Sonnet 5 ou Opus 5 em lote | Lote reduz em 50% o custo do Opus |
| Revisão de segurança ou código crítico | Opus 5 | O custo da falha excede a diferença de tokens |
| Análise científica ou quantitativa | Opus 5 | Maiores ganhos reportados em química e análise de proteínas |
| Protótipos e ferramentas internas | Sonnet 5 | Meça a diferença antes de fazer upgrade |
| Conhecimento de primavera de 2026 sem RAG | Opus 5 | Corte de maio versus janeiro de 2026 |
| UX interativa sensível a latência | Sonnet 5 | Ou Opus 5 em modo rápido se profundidade for inegociável |
A API de Lote merece atenção: o Opus 5 em lote custa US$ 2,50 / US$ 12,50. Isso fica abaixo da tarifa padrão de setembro do Sonnet 5 para entrada e ligeiramente acima para saída. Se o processamento pode ser assíncrono, o Opus pode caber no orçamento.
O que nenhum dos modelos é
O Opus 5 não é o topo absoluto da linha Claude. O Fable 5 continua sendo o modelo mais capaz e amplamente lançado da Anthropic, por US$ 10 / US$ 50.
Além disso, segundo a própria Anthropic, o Opus 5 ainda fica atrás do Mythos 5 em exploração de segurança cibernética e pesquisa de biologia autônoma.
O enquadramento correto é: capacidade de classe de fronteira por cerca de metade do preço de fronteira, mas com um nível superior para cargas de trabalho que realmente precisam dele. Se esse for seu caso, compare Opus 5 vs Fable 5.
Como testar Opus 5 e Sonnet 5 no Apidog
Benchmarks não substituem seus prompts, ferramentas e critérios de aceitação. Como ambos usam o endpoint de Mensagens, o teste A/B é basicamente uma troca de string no campo model.
Configure o teste no Apidog:
- Crie uma requisição para o endpoint de Mensagens da Anthropic.
- Salve a chave como variável de ambiente, em vez de colocá-la no body.
- Crie duas variantes com o mesmo prompt:
claude-opus-5claude-sonnet-5
- Leia o objeto
usageem cada resposta. - Adicione asserções para detectar recusas, respostas truncadas e schemas inválidos.
- Execute uma varredura de
output_config.effortno Opus 5 e compare qualidade, latência e custo.
Exemplo de requisição:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"messages": [
{
"role": "user",
"content": "Refatore este handler para usar I/O assíncrono."
}
]
}'
Ao analisar a resposta, armazene as métricas:
{
"model": "claude-opus-5",
"input_tokens": 0,
"output_tokens": 0,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"passed": true,
"latency_ms": 0
}
Depois, compare os resultados por taxa de sucesso e custo por execução válida:
custo_por_resultado_valido =
custo_total_das_execucoes / numero_de_resultados_aprovados
Duas armadilhas importantes:
- O pensamento adaptativo está ativado por padrão nos dois modelos.
max_tokenslimita pensamento e resposta visível juntos; um limite que funcionava em modelos anteriores pode causar truncamento. - No Opus 5, combinar
thinking: {type: "disabled"}com esforçoxhighoumaxretorna HTTP 400.
Use o Apidog para executar as duas variantes lado a lado. Para o fluxo completo, consulte o passo a passo da API do Opus 5 e o guia do parâmetro de esforço.
Perguntas frequentes
O Claude Opus 5 vale 2,5x o preço do Sonnet 5?
Para agentes de código de longa duração, uso de computador e tarefas caras de errar, pode valer. Para classificação, extração e chat de alto volume, geralmente não. A diferença é de 2,5x até 1º de setembro de 2026 e de aproximadamente 1,67x depois disso.
Quando o preço do Claude Sonnet 5 muda?
A tarifa introdutória de US$ 2 / US$ 10 vai até 31 de agosto de 2026. Em 1º de setembro de 2026, muda para US$ 3 / US$ 15. O Opus 5 permanece em US$ 5 / US$ 25.
Opus 5 e Sonnet 5 tokenizam texto de forma diferente?
Não. Ambos usam o tokenizador de geração 4.7. Texto idêntico produz a mesma contagem de tokens de entrada nos dois modelos. O aumento aproximado de 30% documentado pela Anthropic se aplica em comparação com Sonnet 4.6 e modelos anteriores.
Posso alternar entre Opus 5 e Sonnet 5 sem mudanças no código?
Na maior parte dos casos, sim. Ambos adotam pensamento adaptativo por padrão e rejeitam parâmetros de amostragem não padrão. Observe as diferenças de esforço: o Opus 5 inclui max, usa high como padrão e retorna 400 se o pensamento estiver desativado com xhigh ou max.
Qual modelo a Anthropic recomenda por padrão?
A documentação recomenda começar pelo Opus 5 em caso de dúvida. Isso é uma recomendação de capacidade, não uma análise de custo. Teste se o Sonnet 5 atinge os mesmos critérios por menos. A comparação Sonnet 5 vs Opus 4.8 também ajuda a entender o posicionamento entre os níveis.
Para especificações, benchmarks e disponibilidade, comece em o que é Claude Opus 5, além da postagem de lançamento do Opus 5 e da visão geral de modelos da Anthropic.


Top comments (0)