Quanto você pode delegar para agentes de IA? 🤖
Um framework simples que a PostHog publicou no newsletter build mode mostra que a autonomia de agentes não depende do modelo — depende da tarefa.
Duas perguntas definem o teto:
1. É fácil verificar o trabalho do agente?
2. É barato desfazer o erro do agente?
Isso gera 4 níveis de autonomia:
Nível 0: Agente assistente
Difícil verificar + Caro de desfazer
→ ChatGPT, autocomplete no Cursor. Você no controle.
Nível 1: Humano no loop
Difícil verificar + Barato de desfazer
→ Refatorações de legibilidade, naming, design. Gosto é subjetivo.
Nível 2: Delegação para agentes
Fácil verificar + Caro de desfazer
→ Testes determinísticos funcionam, mas o blast radius é alto. Precisa de gates de segurança.
Nível 3: Modo autônomo
Fácil verificar + Barato de desfazer
→ Bumps de dependência, lint fixes, cobertura de testes. O agente roda solo.
O insight principal: você pode engenheirar seu pipeline para subir uma tarefa de nível. Adicione guardrails, políticas de dry-run, feature flags e métricas de sucesso.
A PostHog está indo all-in no Nível 3 com os Scouts — agentes que investigam sinais de produto em segundo plano e abrem PRs autonomamente.
O futuro não são modelos melhores. São pipelines melhores.
Em qual nível seus agentes estão operando?
Publicado originalmente em PostHog's newsletter por Jina Yoon.

Top comments (0)