DEV Community

Cover image for Prompts para Claude Fable 5.1: Cada Desvio de Comportamento e o Comando Que o Corrige
Lucas
Lucas

Posted on Originally published at apidog.com

Prompts para Claude Fable 5.1: Cada Desvio de Comportamento e o Comando Que o Corrige

Prompting do Claude Fable 5.1: ajustes práticos para agentes e fluxos de código

A Anthropic afirma que seus prompts existentes do Fable 5 devem ter um bom desempenho no Claude Fable 5.1 sem alterações. Isso vale principalmente para as respostas. O comportamento ao redor delas mudou: o modelo pode agrupar menos chamadas de ferramenta, narrar menos, escrever prosa mais densa, formatar menos o chat, reescrever arquivos inteiros para alterar uma linha e pedir permissão para etapas já incluídas na solicitação. Cada mudança tem uma correção específica no guia de prompting da Anthropic para Claude Fable 5.1.

Experimente o Apidog hoje

Este guia reúne as principais diferenças entre o Fable 5 e o Fable 5.1, com as instruções recomendadas e as regras de posicionamento que afetam o pensamento preservado e o cache de prompts. Para uma visão geral, consulte o que é Claude Fable 5.1.

1. Comece pelo esforço, não pelo prompt

O esforço é o controle principal para equilibrar inteligência, latência e custo no Fable 5.1. Ajuste-o antes de alterar o prompt.

Comece com o padrão high e teste os outros quatro níveis usando suas próprias avaliações. Repita a varredura mesmo que você já tenha feito isso no Fable 5: os nomes dos níveis não representam a mesma quantidade de raciocínio entre os modelos. Consulte a documentação sobre esforço.

Teste estas alegações da Anthropic:

  • Em medium, os resultados são aproximadamente equivalentes aos do Fable 5, com menor custo.
  • Em low, o Fable 5.1 costuma competir com Opus e Sonnet em custo por tarefa, obtendo pontuações mais altas.
  • Os ganhos sobre o Fable 5 são maiores em xhigh e max.

No Fable 5.1, é possível alterar o esforço no meio da conversa sem resetar o cache. Para isso, use uma mensagem role: "system" com conteúdo vazio e output_config, utilizando o cabeçalho beta mid-conversation-output-config-2026-07-01. O formato completo está no passo a passo da API.

2. O posicionamento da instrução importa

Os blocos de pensamento do Fable 5.1 só são válidos na conversa exata que os produziu. Se você injeta um lembrete em um turno anterior e o remove na próxima requisição, está editando o histórico: o cache de prompt é reiniciado e, para contas criadas em ou após 31 de agosto de 2026, cada bloco de pensamento posterior é invalidado.

Instruções específicas de um turno devem ficar em um destes locais.

Com mid-conversation-system-clear

Com a versão beta mid-conversation-system-clear-at-2026-08-21, adicione a instrução como uma mensagem de sistema com escopo de turno, depois da mensagem de resultado da ferramenta:

{"role": "system", "clear_at": "next_user_message", "content": "..."}
Enter fullscreen mode Exit fullscreen mode

Mantenha todas as cópias anteriores no array. Quando uma mensagem de usuário posterior existir, a API limpará as cópias anteriores. O modelo lerá apenas a instrução mais recente, e as cópias limpas não consumirão tokens. Veja o guia de pensamento preservado e a documentação de mensagens de sistema com escopo de turno.

Sem a versão beta

Coloque a instrução em um bloco de texto depois dos blocos tool_result, na mesma mensagem do usuário. Mantenha as cópias anteriores. Nunca apague nem reescreva uma cópia já enviada.

Instruções de nível de sessão devem ficar no prompt do sistema ou no primeiro turno do usuário. A Anthropic observa que instruções de estilo no primeiro turno do usuário funcionam melhor do que o mesmo texto no prompt do sistema.

3. Agrupe chamadas de ferramenta em loops de agentes

Quando uma requisição nomeia vários itens para buscar, o Fable 5.1 emite chamadas em paralelo. Porém, em loops de codificação e uso de computador nos quais as próximas leituras independentes são apenas implícitas, ele pode emitir uma chamada por turno, enquanto o Fable 5 agrupava várias.

As respostas não mudam, mas cada turno adicional custa tokens, uma viagem de ida e volta e tempo de execução.

Meça antes de corrigir

Acompanhe a proporção de turnos do assistente com mais de uma chamada de ferramenta. Só adicione a correção se essa proporção estiver diminuindo.

Anexe a seguinte instrução após cada mensagem de resultado da ferramenta, como uma mensagem de sistema com escopo de turno:

First privately list what you need next; then request every item that doesn't depend on another's result in this one response.
Enter fullscreen mode Exit fullscreen mode

Mantenha a palavra privately. Sem ela, o modelo pode responder ao lembrete em vez de continuar atendendo ao usuário. Uma instrução próxima do final da requisição atual influencia mais esse comportamento do que o mesmo texto no prompt do sistema.

4. Mostre atualizações durante chamadas de ferramentas

O Fable 5.1 escreve menos atualizações durante turnos longos com chamadas de ferramentas, especialmente com níveis de esforço maiores. O usuário pode ver o agente em silêncio por minutos ou receber uma mensagem final que menciona apenas o último passo.

Aplique as correções nesta ordem:

  1. Habilite atualizações de pensamento.

    Notas intermediárias retornam como blocos thinking, mas ficam vazias quando display: "omitted" é usado. Defina display: "updates" com o cabeçalho beta thinking-display-updates-2026-08-18 e renderize cada bloco de pensamento não vazio como uma linha de status.

  2. Remova instruções antigas.

    Elimine frases voltadas para modelos que produziam muitas atualizações, como “mantenha todas as descobertas para a resposta final”.

  3. Peça uma narrativa curta, se necessário.

Before you start, say in a line what you're about to do; brief updates while you work help the user follow along. Close with a short recap that stands on its own, covering what you found, what you did, and what's next, so a reader who only sees the last message has the full picture.
Enter fullscreen mode Exit fullscreen mode

Se o seu produto oculta a saída das ferramentas, informe isso ao modelo com uma mensagem de sistema com escopo de turno:

Apenas você vê a saída desse comando. Se o usuário precisar ler algo dela, inclua-o em sua resposta.
Enter fullscreen mode Exit fullscreen mode

Caso contrário, o modelo poderá executar comandos para “mostrar” ao usuário uma saída que eles nunca verão.

5. Evite que o turno termine antes da tarefa

Em cargas de trabalho assíncronas complexas, o Fable 5.1 pode descrever o que faria em seguida em vez de executar a etapa. Também pode pedir permissão para algo já incluído na requisição, obrigando o usuário a responder “continue”.

Use este bloco no prompt do sistema:

You are operating autonomously. The user is not watching in real time and cannot answer questions mid-task, so asking 'Want me to...?' or 'Shall I...?' will block the work. For reversible actions that follow from the original request, proceed without asking. Stop only for destructive actions or genuine scope changes the user must decide. Offering follow-ups after the task is done is fine; asking permission before doing the work is not.

Before ending your turn, check your last paragraph. If it is a plan, an analysis, a question, a list of next steps, or a promise about work you have not done, do that work now with tool calls. End your turn only when the task is complete or you are blocked on input only the user can provide.
Enter fullscreen mode Exit fullscreen mode

A Anthropic recomenda associá-lo a um segundo bloco que define a requisição do usuário como o escopo do entregável:

  • não estreite, amplie ou troque o escopo;
  • conclua tudo que não estiver bloqueado;
  • informe o que ficou de fora;
  • trate descobertas não solicitadas como sugestões, não como mudanças;
  • liste as confirmações que ainda dependem do usuário.

Essa combinação pode reduzir a tendência de fazer perguntas em requisições ambíguas. Diferentemente da recomendação para Opus 5, mantenha as instruções para verificar o próprio trabalho.

6. Evite correções não solicitadas e arquivos de teste extras

Em uma funcionalidade aberta, o Fable 5.1 pode implementar o pedido e também corrigir problemas próximos, ampliar comportamentos ou adicionar mais testes do que a mudança justifica.

A Anthropic afirma que a instrução abaixo reduz esses extras sem diminuir o sucesso da tarefa:

If, while working or testing, you find a pre-existing bug, a performance concern, or behavior the task doesn't mention, don't fix, optimize or extend it in this change unless the requested behavior cannot work without it; report it as a follow-up in your summary. Verify your work however you like; scratch scripts and quick checks need not be kept. Commit tests only where the task asks for them or this repository already keeps tests for this kind of change, sized like the neighboring test files. This is about extras only: implement every behavior the task asks for, completely.
Enter fullscreen mode Exit fullscreen mode

A regra vale apenas para extras. Todo comportamento solicitado deve ser implementado completamente.

7. Prefira edições direcionadas

O Fable 5.1 é mais propenso que o Fable 5 a reescrever um arquivo inteiro para fazer uma pequena alteração. O resultado pode ser o mesmo, mas o custo em tokens de saída é maior.

Adicione esta instrução ao prompt do sistema ou à primeira mensagem do usuário:

The number of tokens used to edit files is best minimized, all else being equal. Therefore, when it will not affect the end result, try to surgically edit a file rather than rewrite the entire thing.
Enter fullscreen mode Exit fullscreen mode

8. Reduza a prosa longa e densa

A escrita do Fable 5.1 costuma melhorar, com menos frases clichês. Em alguns casos, porém, ela fica mais densa: frases longas e menos quebras de parágrafo.

Defina o antipadrão explicitamente. A Anthropic descreve “prosa afetada” como uma escrita que substitui declarações diretas por metáforas e floreios, exibindo o escritor em vez de transmitir a ideia. Peça que o modelo diga exatamente o que quer dizer e use a formulação literal quando ela estiver disponível.

Uma versão curta é suficiente:

Por favor, remova toda a prosa afetada.
Enter fullscreen mode Exit fullscreen mode

9. Permita a estrutura que o conteúdo exige

Modelos anteriores abusavam de marcadores e negrito, por isso muitos prompts incluem regras contra formatação. O Fable 5.1 tende ao extremo oposto: usa menos negrito, cabeçalhos e listas. Regras antigas podem agora suprimir a estrutura necessária.

Remova a linguagem anti-formatação ou substitua-a por regras contextuais:

  • use listas quando solicitado ou quando o conteúdo tiver várias partes;
  • use formatação para melhorar a clareza;
  • respeite pedidos explícitos de formatação mínima;
  • mantenha a prosa simples em conversas informais ou emocionais.

10. Marque citações em resumos

Ao resumir documentos, o Fable 5.1 é mais propenso que o Fable 5 a reproduzir passagens da fonte sem indicar que são citações.

Inclua no prompt do sistema um exemplo completo contendo:

  1. a requisição do usuário;
  2. uma resposta correta que transmita cada fonte em discurso indireto;
  3. no máximo uma citação curta, devidamente marcada;
  4. uma justificativa de uma frase explicando por que a resposta está correta.

No exemplo da Anthropic, substitua os placeholders de chamadas de ferramenta pelo nome da ferramenta do seu produto.

11. Não confie apenas na memória com esforço low

Com esforço low, o Fable 5.1 chama ferramentas de busca e recuperação com menos frequência que o Fable 5. Isso é mais visível para produtos e modelos nomeados que ele reconhece, mas cujo estado atual pode estar desatualizado.

Use uma destas correções:

  • aumente o esforço nos turnos afetados usando o esforço por mensagem;
  • diga no prompt do sistema que reconhecer um nome em uma área de rápida mudança não significa conhecer seu estado atual;
  • instrua o modelo a pesquisar antes de responder;
  • peça que ele inclua o nome exatamente como foi escrito pelo usuário em pelo menos uma consulta.

12. Controle entregáveis longos em xhigh e max

Em xhigh e, especialmente, max, o Fable 5.1 pode rascunhar grande parte de um entregável no pensamento e depois escrevê-lo novamente na resposta. Isso dobra o tempo de espera e os tokens de saída.

Faça o seguinte:

  1. Execute a requisição em high e aumente o esforço apenas quando houver ganho medido.
  2. Se permanecer em xhigh ou max, defina max_tokens com espaço suficiente para o pensamento e a resposta.
  3. Mantenha esta observação na mensagem do usuário em requisições posteriores:
Tudo produzido em uma resposta, incluindo o raciocínio, conta para um único limite de aproximadamente o seu max_tokens real. Compor o entregável na íntegra como raciocínio e novamente como resposta dobra o turno sem melhorá-lo.
Enter fullscreen mode Exit fullscreen mode

Mantenha as cópias anteriores dessa nota em vigor nas requisições seguintes.

13. Reduza recusas em tarefas benignas de código

Os classificadores do Fable 5.1 produzem menos falsos positivos que os do Fable 5 no lançamento, e encontrar vulnerabilidades no código-fonte agora é permitido. Ainda assim, recusas indevidas podem ocorrer.

Experimente estas reformulações:

  • pergunte “Existem erros neste programa?” em vez de “Este programa compila sem erros?”;
  • forneça documentação para linguagens menos conhecidas;
  • remova ferramentas que retornam dados codificados em Base64 para o contexto;
  • mantenha os fallbacks configurados de forma independente.

Consulte o guia de tratamento de recusas.

14. Preserve detalhes em resumos de compactação no cliente

O Fable 5.1 responde bem quando recebe instruções precisas sobre o que um resumo de compactação deve preservar. A compactação no lado do servidor já aplica esse comportamento.

Se você compactar o contexto no cliente, peça que o modelo responda dentro de tags <summary> e preserve, nesta ordem:

  1. dificuldades encontradas e como foram resolvidas;
  2. abordagens consideradas ou descartadas e o motivo;
  3. tudo o que foi solicitado ou decidido, com a redação exata;
  4. o estado atual;
  5. itens ainda em aberto;
  6. detalhes difíceis de reconstruir, como nomes, números e links.

Finalize com:

Não chame nenhuma ferramenta ao escrever este resumo; responda apenas com texto
Enter fullscreen mode Exit fullscreen mode

Essa última instrução é importante quando a requisição de sumarização ainda contém as ferramentas da conversa.

15. Ajuste a arquitetura de subagentes e visão

Duas melhorias são arquiteturais, não apenas mudanças de prompt.

Subagentes em tarefas de codificação

Permita que o agente principal continue trabalhando enquanto os subagentes executam:

  • faça a ferramenta que inicia um subagente retornar imediatamente;
  • entregue cada resultado em uma mensagem de usuário posterior;
  • forneça ao agente principal uma ferramenta separada para esperar quando necessário.

Gráficos densos e tabelas aninhadas

Forneça ao modelo uma ferramenta de recorte que retorne uma região ampliada ou um contêiner com bibliotecas básicas de imagem. Com esforço low, o modelo pode ignorar o recorte; verifique os logs para confirmar se a ferramenta foi chamada.

Imagem 50

Imagem 51

16. Teste as mudanças de prompt no Apidog

Cada correção acima pode ser validada com um teste antes/depois:

  1. salve os três primeiros turnos do loop do agente como uma sequência de requisições;
  2. parametrize o prompt do sistema;
  3. execute a sequência com e sem cada trecho, usando o mesmo nível de esforço;
  4. compare os resultados.

Métricas úteis:

  • Agrupamento de ferramentas: conte os blocos tool_use por turno do assistente.
  • Edições direcionadas e densidade: acompanhe usage.output_tokens.
  • Autonomia: verifique a ausência de um parágrafo final que comece com “Em seguida, eu”.

Baixe o Apidog para montar esses testes. O guia Claude Code mostra quais dessas instruções podem pertencer a um arquivo CLAUDE.md.

FAQ

Meus prompts do Fable 5 funcionam no Fable 5.1?

A Anthropic afirma que eles devem ter um bom desempenho sem alterações. As diferenças são comportamentais: menos chamadas de ferramentas agrupadas, menos atualizações de progresso, prosa mais densa, menos formatação no chat, mais reescritas de arquivos inteiros e maior desvio de escopo em tarefas abertas.

Qual nível de esforço devo usar?

Comece em high e faça uma nova varredura. A Anthropic afirma que medium se aproxima do Fable 5 com menor custo, enquanto low costuma ser competitivo com Opus e Sonnet em custo por tarefa.

Onde devo colocar uma instrução específica de um turno?

Use uma mensagem de sistema com clear_at: "next_user_message" depois dos resultados das ferramentas, mantendo as cópias anteriores no array. Injetar e remover texto de turnos anteriores invalida blocos de pensamento posteriores e reinicia o cache.

Devo remover instruções como “verifique seu trabalho”?

Não. Essa recomendação era específica para a superverificação do Opus 5. Mantenha as instruções no Fable 5.1. Consulte o conselho do Opus 5 sobre instruções de verificação.

Como impedir que o Fable 5.1 reescreva arquivos inteiros?

Adicione esta linha ao prompt do sistema ou à primeira mensagem do usuário:


text
The number of tokens used to edit files is best minimized, all else being equal. Therefore, when it will not affect the end result, try to surgically edit a file rather than rewrite the entire thing.
Enter fullscreen mode Exit fullscreen mode

Top comments (0)