Erik Schluntz e Barry Zhang — comece simples, e só dê agência ao sistema quando ela pagar
"O sucesso no espaço dos LLMs não é sobre construir o sistema mais sofisticado. É sobre construir o sistema certo para a sua necessidade." — Erik Schluntz e Barry Zhang, Building Effective Agents (Anthropic, dez/2024)
O essencial em 30 segundos
Em dezembro de 2024, dois engenheiros da Anthropic — Erik Schluntz e Barry Zhang — publicaram o guia Building Effective Agents, que virou referência por um motivo contraintuitivo: ele recomenda que você não construa um agente na maioria dos casos. Depois de trabalhar com dezenas de times montando aplicações com LLMs, eles relatam que as implementações mais bem-sucedidas "não usavam frameworks complexos nem bibliotecas especializadas", mas sim padrões simples e componíveis.
A tese tem dois movimentos. Primeiro, uma distinção precisa: workflows são sistemas onde LLMs e ferramentas são orquestrados por caminhos de código predefinidos; agentes são sistemas onde o LLM dirige dinamicamente o próprio processo e uso de ferramentas. Segundo, uma regra de ouro: comece com o prompt mais simples, meça com avaliação, e só adicione passos agênticos quando as soluções simples claramente não bastarem — porque agência compra capacidade ao custo de latência, custo e imprevisibilidade.
Para um operador que vai colocar nove agentes de IA dentro de um SaaS B2B (o Gestão de Colabs), este guia é o filtro: a maioria desses "agentes" deveria nascer como workflow, e a autonomia plena entra só onde o ganho justifica a complexidade.
Quem são
Erik Schluntz é membro do staff técnico (Member of Technical Staff) na Anthropic, onde atua desde fevereiro de 2024 em modelos de linguagem, com foco em tool use, computer use e benchmarks de engenharia de software como o SWE-bench. Tem formação em Engenharia Elétrica por Harvard (bacharelado e mestrado). Antes da Anthropic, teve uma trajetória que explica seu pragmatismo: trabalhou no time de software de voo da SpaceX (testes de um novo sistema de combustível do Falcon 9) e no projeto da lente de contato inteligente do Google[x]. Em 2016 co-fundou a Cobalt Robotics — robôs de segurança autônomos para escritórios e armazéns — onde foi CTO até 2024, levando a empresa por rodadas de investimento e implantações globais. Quem passou anos construindo robôs que operam sozinhos em ambientes reais aprende cedo que autonomia é cara e perigosa quando não é necessária — e isso transparece no guia.
Barry Zhang é membro do staff técnico no time de Applied AI da Anthropic. É um dos principais divulgadores das ideias do guia: apresentou a palestra How We Build Effective Agents no AI Engineer Summit de 2025, em Nova York, onde reforçou três princípios — não aplique agentes a todo problema; priorize simplicidade na arquitetura inicial para iterar rápido; e "pense como o seu agente". Zhang também sintetiza a arquitetura mínima de um agente em três peças: ambiente (o contexto e estado externos em que o agente opera), ferramentas (as interfaces de ação e feedback que ele pode chamar) e system prompt (que codifica metas, restrições e comportamento desejado).
Os dois co-assinam Building Effective Agents, baseado na experiência de construir agentes dentro da Anthropic e no que aprenderam com clientes construindo os seus.
A grande contribuição
A grande contribuição do guia é desinflar o hype com vocabulário preciso. Em 2024–2025, "agente" virou palavra-ônibus: qualquer coisa que chamava um LLM mais de uma vez era vendida como "agente autônomo". Schluntz e Zhang cortam o nó com uma definição operacional clara — e, crucialmente, colocam workflows e agentes sob um guarda-chuva comum ("sistemas agênticos"), em vez de tratar um como inferior ao outro.
A segunda contribuição é o catálogo de padrões. Em vez de prescrever um framework, eles descrevem cinco padrões de workflow e um padrão de agente, do mais simples ao mais complexo, com a orientação de subir nessa escada só quando preciso. Isso transforma "como construir um agente?" de uma pergunta de moda em uma decisão de engenharia: qual o padrão mais simples que resolve este problema com qualidade aceitável?
A terceira é a postura filosófica: três princípios de design — manter a simplicidade; priorizar transparência mostrando explicitamente os passos de planejamento do agente; e caprichar na interface agente-computador (documentar bem as ferramentas, como se documenta uma API para humanos). É um guia que respeita a complexidade do problema sem fetichizar a complexidade da solução.
As ideias-chave
1. Workflow vs. agente: a distinção que organiza tudo
A definição é a fundação. Workflows orquestram LLMs e ferramentas por caminhos de código predefinidos — você desenhou o fluxo, o modelo preenche as lacunas. Agentes deixam o LLM dirigir dinamicamente o próprio processo e uso de ferramentas, mantendo controle sobre como cumpre a tarefa. A diferença não é técnica apenas; é de previsibilidade e custo. Workflow é determinístico no esqueleto; agente é aberto.
Exemplo no portfólio: no Gestão de Colabs, "gerar o resumo mensal de ponto de um colaborador" é um workflow — os passos são conhecidos e fixos. Já "investigar uma divergência incomum de banco de horas, decidindo sozinho quais registros consultar" tem cara de agente. Saber qual é qual evita superengenharia no primeiro caso e ingenuidade no segundo.
2. Os cinco padrões de workflow (a escada antes do agente)
O guia apresenta, em ordem crescente de complexidade:
- Prompt chaining (encadeamento): decompõe a tarefa em passos sequenciais, onde cada chamada processa a saída da anterior, com gates programáticos opcionais para validar antes de seguir.
- Routing (roteamento): classifica a entrada e a direciona para um fluxo especializado, permitindo prompts otimizados por categoria e separação de responsabilidades.
- Parallelization (paralelização): roda tarefas em paralelo — por sectioning (subtarefas independentes) ou voting (várias tentativas para a mesma coisa) — e agrega os resultados.
- Orchestrator-workers (orquestrador-trabalhadores): um LLM central decompõe a tarefa dinamicamente e delega a LLMs trabalhadores, sintetizando os resultados.
- Evaluator-optimizer (avaliador-otimizador): um LLM gera a resposta e outro a avalia e devolve feedback, num laço de refinamento iterativo.
Exemplo no portfólio: a triagem de solicitações de colaborador no Gestão de Colabs é routing puro — classifica (férias, reembolso, dúvida de benefício) e manda para o template certo. Gerar uma comunicação interna e revisá-la antes de publicar é evaluator-optimizer. Nenhum dos dois precisa de um agente autônomo; ambos são robustos e baratos.
3. O agente: laço, ferramentas e feedback do ambiente
Quando o problema realmente exige, o padrão de agente entra: começa com um comando ou conversa do usuário, então "planeja e opera de forma independente, potencialmente voltando ao humano para mais informação ou julgamento". O agente opera num laço com feedback do ambiente — age, observa o resultado, decide o próximo passo. A arquitetura mínima (na formulação de Zhang) é ambiente + ferramentas + system prompt. Agentes brilham em tarefas que combinam conversa e ação, têm critério claro de sucesso, permitem laços de feedback e integram supervisão humana significativa.
Exemplo no portfólio: um agente que ajuda o RH a montar um plano de onboarding personalizado — consultando políticas, checando disponibilidade de sistemas, propondo um cronograma e ajustando conforme o gestor responde — é candidato legítimo a agente: tem critério de sucesso, laço de feedback e humano no meio.
4. Comece simples: agência só quando o ganho justifica a complexidade
O coração do guia: "comece com prompts simples, otimize-os com avaliação abrangente, e adicione sistemas agênticos de múltiplos passos só quando soluções mais simples ficarem aquém". E o critério para subir a escada: "você deveria considerar adicionar complexidade só quando ela demonstravelmente melhora os resultados". Agência é um custo — em latência, em dinheiro, em imprevisibilidade — que você paga em troca de capacidade. Se a capacidade extra não é necessária, o custo é desperdício.
Exemplo no portfólio: a tentação, com nove agentes no roadmap, é torná-los todos "autônomos e inteligentes". O guia diz o contrário: prove primeiro que um prompt único resolve; se não, suba para chaining; se não, routing; e assim por diante. A maioria vai parar em workflow. A agência plena fica reservada para os poucos casos onde ela paga.
5. Transparência e interface agente-computador (ACI)
Dois dos três princípios de design são frequentemente ignorados: transparência (mostrar explicitamente os passos de planejamento do agente, para que o sistema seja auditável e depurável) e a interface agente-computador (documentar e desenhar as ferramentas com o mesmo cuidado de uma API para um desenvolvedor humano). Um agente só é tão bom quanto as ferramentas que damos a ele e quanto a clareza com que descrevemos essas ferramentas.
Exemplo no portfólio: se um agente do Gestão de Colabs pode "consultar saldo de férias", a tool precisa de descrição inequívoca, parâmetros claros e mensagens de erro úteis — exatamente como eu documentaria um endpoint para um cliente integrar. E cada passo do agente fica logado e visível, para que o gestor (e eu) consigamos auditar por que ele decidiu o que decidiu.
Em suas palavras
"As implementações mais bem-sucedidas não usavam frameworks complexos nem bibliotecas especializadas." — Building Effective Agents (Anthropic, 2024)
"Workflows são sistemas onde LLMs e ferramentas são orquestrados por caminhos de código predefinidos. Agentes são sistemas onde os LLMs dirigem dinamicamente os próprios processos e uso de ferramentas, mantendo controle sobre como cumprem as tarefas." — Building Effective Agents (Anthropic, 2024)
"Comece com prompts simples, otimize-os com avaliação abrangente e adicione sistemas agênticos de múltiplos passos apenas quando soluções mais simples ficarem aquém." — Building Effective Agents (Anthropic, 2024)
"Você deveria considerar adicionar complexidade apenas quando ela demonstravelmente melhora os resultados." — Building Effective Agents (Anthropic, 2024)
"O sucesso no espaço dos LLMs não é sobre construir o sistema mais sofisticado. É sobre construir o sistema certo para a sua necessidade." — Building Effective Agents (Anthropic, 2024)
Limites e críticas
O guia é deliberadamente minimalista, e isso tem custos. Ele oferece padrões e princípios, mas pouco sobre os detalhes operacionais difíceis: avaliação rigorosa (como medir "qualidade aceitável" de forma confiável em produção?), monitoramento de agentes em escala, controle de custo quando muitos agentes rodam em paralelo, e segurança quando agentes têm acesso a ferramentas que tomam ações reais. São justamente as partes que mais dão trabalho — e que o leitor desavisado pode subestimar por causa do tom "simples".
Há também uma tensão saudável com a posição de quem vende orquestração com estado (como a LangChain/LangGraph). O guia dispensa frameworks na maioria dos casos; já Harrison Chase argumenta que, para agentes de longa duração com human-in-the-loop e persistência, um framework de baixo nível ajuda. As duas posições não são incompatíveis — o ponto comum é não usar abstrações grossas que escondem o contexto —, mas o leitor precisa entender que "não use framework" vale melhor para sistemas simples do que para agentes de horizonte longo.
Por fim, "comece simples" pode virar desculpa para nunca evoluir. O critério correto não é "sempre o mais simples", e sim "o mais simples que atinge a qualidade necessária" — e isso exige medir de verdade, não chutar.
Como aplicar no seu dia a dia
Ao construir agentes de IA para um produto, adote o guia como processo de decisão obrigatório antes de escrever código:
-
Defina primeiro: isto é workflow ou agente? Se os passos são conhecidos e fixos, é workflow — e fica determinístico, barato e testável. Classifique como agente só o que de fato exige decisão dinâmica sobre quais ferramentas usar e quando parar. Na dúvida, aposte que a maioria dos casos cai em workflow.
-
Suba a escada de padrões, um degrau por vez. Para cada caso: tente prompt único → se falha, prompt chaining com gate de validação → se precisa de especialização, routing → se há subtarefas independentes ou voto, parallelization → só então orchestrator-workers ou evaluator-optimizer. A agência plena é o último recurso, não o primeiro.
-
Adicione agência só quando ela demonstravelmente melhora o resultado. Antes de tornar um agente autônomo, meça: o workflow simples já entrega qualidade aceitável? Se sim, parou. A complexidade extra precisa pagar em resultado mensurável, não em sensação de sofisticação.
-
Trate ferramentas como API de produto. Cada tool que você dá a um agente (consultar saldo, abrir solicitação, notificar o responsável) ganha descrição clara, parâmetros explícitos e erros úteis. A interface agente-computador é onde o agente acerta ou erra.
-
Transparência por design e humano nas ações irreversíveis. Cada passo de planejamento fica logado e auditável; toda ação que mexe em dado ou dinheiro passa por aprovação humana. Isso dá a você um produto confiável — e depurável quando algo dá errado.
A síntese é a frase deles: não queira o sistema mais sofisticado, queira o sistema certo. Para um produto que vende confiabilidade, o sistema certo costuma ser o workflow simples — com agência cirúrgica onde, e só onde, ela paga.
Para ir além
Comece por: o guia Building Effective Agents da Anthropic (dezembro/2024) — leitura curta e direta, é o documento-base deste post. Está resumido no vault.
Depois: a palestra de Barry Zhang, How We Build Effective Agents (AI Engineer Summit 2025), para ver os três princípios e a arquitetura mínima (ambiente + ferramentas + system prompt) explicados ao vivo; e a entrevista de Erik Schluntz no podcast Latent Space sobre o novo Claude 3.5 Sonnet, computer use e construção de agentes SOTA, para entender o pragmatismo de quem vem da robótica.
Avançado: estude avaliação de agentes a sério (como medir qualidade em produção) e a discussão sobre interface agente-computador (ACI) e tool design; depois confronte com a visão de framework de Harrison Chase para formar sua própria posição sobre quando vale orquestração com estado.
Conexões no vault
- IA e Tecnologia
- anthropic-building-effective-agents — o resumo do guia que é a fonte primária deste post
- langchain-harrison-chase-lance-martin — Chase e Martin (LangChain) sobre o outro lado do debate framework vs. build
- andrej-karpathy — pragmatismo de engenharia de IA que dialoga com o "comece simples"