A Arte da Engenharia de Loops

@sydneyrunkle
INGLÊS16/06/2026
243K
1.6K
249
30
3.9K

TL;DR

Este artigo explora o 'loopcraft', uma estrutura para empilhar loops de agentes, verificação, orientados a eventos e de escalada (hill-climbing) para criar agentes de IA que automatizam o trabalho, garantem a qualidade e melhoram continuamente.

Agentes são úteis porque nos ajudam a automatizar o trabalho ao realizar ações no mundo real. Mas conseguir que agentes realizem trabalhos valiosos de forma confiável exige mais do que apenas um bom modelo: requer uma arquitetura cuidadosamente projetada e adequada a um conjunto de tarefas.

O algoritmo central do agente é simples: dar contexto ao LLM e deixá-lo chamar ferramentas em um loop até que a tarefa seja concluída. Este é o loop mais fundamental. Mas está longe de ser o único loop que impulsiona os agentes. @swyx escreveu recentemente um ótimo artigo sobre "loopcraft: a arte de empilhar loops", a ideia de que você pode empilhar e estender loops para construir agentes mais eficazes.

Veja como pensamos sobre essa pilha e como instrumentar cada nível com os primitivos do LangChain.

Loop 1: O Agente

Em sua essência, um agente é apenas um modelo chamando ferramentas em um loop até que uma tarefa seja concluída.

Sydney Runkle - inline image

Isso é o que o create_agent do LangChain oferece. Escolha qualquer modelo, conecte ferramentas e você terá um loop de agente funcional. As ferramentas são o que dão ao agente o poder de agir no mundo real.

Pegue nosso agente de documentação interna como exemplo (que usaremos como exemplo motivador para o restante deste blog). No primeiro nível do loop, ele recebe uma solicitação de melhoria na documentação, o modelo planeja e rascunha as alterações, e usa ferramentas para clonar repositórios, ler arquivos, escrever documentação, abrir um pull request, etc.

Sydney Runkle - inline image

Nível 2: Loop de Verificação

O loop do agente faz o trabalho, mas nem sempre produz resultados corretos ou consistentes na primeira tentativa. Quando a consistência é importante, muitas vezes é útil envolvê-lo em um loop de verificação que confere a saída e envia feedback de volta ao modelo quando algo está aquém.

Sydney Runkle - inline image

O loop de verificação adiciona um avaliador: algo que verifica a saída do agente em relação a uma rubrica e, se falhar, envia o resultado de volta com feedback. Os avaliadores podem ser determinísticos ou agentivos (LLM como juiz é um exemplo clássico aqui).

O RubricMiddleware lida com esse padrão, ou você pode configurá-lo com um hook after_agent no create_agent.

Para o exemplo do nosso escritor de documentação, o avaliador executa testes após cada tentativa, verificando se todos os links funcionam, se todos os testes de CI passam e se o diff está limitado ao que foi realmente solicitado. Nenhuma revisão manual é necessária para capturar esses tipos de erro.

Sydney Runkle - inline image

Uma desvantagem: adicionar verificação aumenta a latência e o custo por execução. Vale a pena quando a qualidade é mais importante que a velocidade, que é a maioria dos casos de uso em produção.

Nível 3: Loop Orientado a Eventos

Uma das partes mais importantes do desenvolvimento de agentes é a camada de integrações: conectar seu agente ao seu ecossistema para que ele possa ser executado em segundo plano.

O loop orientado a eventos conecta seu agente ao seu ecossistema. Um evento é disparado — um novo documento chega, um agendamento é acionado, um webhook é recebido — e o agente é executado. O agente não é algo que você invoca manualmente; é um componente sendo executado continuamente dentro de um sistema maior.

Sydney Runkle - inline image

O LangSmith Deployment oferece suporte à infraestrutura de gatilhos, incluindo suporte para agendamentos cron e webhooks. Um exemplo popular de crons em ação são os "heartbeats" no openclaw, que transformam seu agente em um assistente proativo e sempre ativo.

Nosso agente de documentação é alimentado pelo Fleet, nosso construtor de agentes sem código. Os canais e agendamentos do Fleet lidam com gatilhos orientados a eventos e estilo cron. Usamos um canal para disparar o agente de documentação sempre que uma mensagem é enviada em nosso canal do Slack #docs-plz.

Sydney Runkle - inline image

Nível 4: Loop de Subida de Encosta

Os três primeiros loops automatizam o trabalho. O quarto (e, sem dúvida, o mais importante) automatiza a melhoria!

Sydney Runkle - inline image

Cada execução de um agente produz um trace: um registro do que o modelo fez, as ferramentas que chamou, o feedback do avaliador, etc. Esses traces contêm sinais de alto valor sobre o que está funcionando e o que não está. O loop de subida de encosta executa um agente de análise sobre esses traces e usa as descobertas para reescrever a arquitetura com uma configuração melhorada. Isso pode incluir ajustes no prompt/ferramentas ou ajustes no avaliador.

No LangSmith, você pode usar o Engine, nosso agente de análise de traces, para instrumentar este quarto loop.

Finalizando a analogia do agente de documentação, executamos o Engine sobre os traces do agente de documentação para detectar quaisquer problemas. Quando vários traces sinalizam um problema potencial, um issue é aberto solicitando alterações no prompt ou ferramenta ofensora.

Sydney Runkle - inline image

O movimento chave aqui é que a seta de retorno não apenas volta ao topo — ela alcança o interior e atualiza o loop do agente diretamente. Cada ciclo do loop externo torna os loops internos mais eficazes.

Olhando para o futuro:

a configuração de prompts e ferramentas são as coisas mais simples de melhorar, mas não são as únicas opções. Para equipes que executam modelos de peso aberto, o loop de subida de encosta pode alimentar o ajuste fino por RL, usando resultados de traces ou avaliações como sinal de treinamento para melhorar o próprio modelo. Contexto auxiliar como memória e habilidades recuperadas pode ser melhorado da mesma forma. O loop é o padrão; o que ele otimiza depende de você.

Supervisão e Expertise Humana

Automação não significa remover os humanos do loop. Em todos os níveis, existem pontos naturais onde a supervisão humana agrega valor. Um avaliador automatizado pode verificar se os links funcionam; é preciso um humano para perceber que o enquadramento está errado para o público. Esse tipo de julgamento, conquistado através de contexto, experiência e bom gosto, é exatamente onde a revisão humana mostra seu valor.

Alguma expertise deve ser codificada nos próprios prompts/ferramentas, mas para ações sensíveis, a revisão humana ao vivo é essencial (pense em transações financeiras, operações de banco de dados, etc). O LangChain torna simples instrumentar esses pontos de contato em cada loop:

  1. No loop do agente, exija entrada humana antes de ações/chamadas de ferramentas sensíveis.
  2. No loop de verificação, um humano pode atuar como avaliador para fluxos de trabalho sensíveis.
  3. No loop da aplicação, um humano pode aprovar saídas antes de serem retornadas ao usuário final.
  4. No loop de subida de encosta, as melhorias na arquitetura podem passar por revisão humana antes da implantação.

Todos os frameworks de código aberto do LangChain tornam a adição de um "humano no loop" um primitivo de primeira classe.

Juntando Tudo

Caso você prefira uma visão mais tabular, aqui está como esses quatro loops se empilham:

Loop

O que faz

Impacto

Primitivo LangChain

1: Loop do Agente (modelo + ferramentas)

O modelo chama ferramentas repetidamente até que uma tarefa seja concluída

Automatizar trabalho

create_agent, qualquer modelo suportado pelo LangChain

2: Loop de Verificação (agente + avaliador)

O agente é executado, a saída é avaliada contra uma rubrica, repetida com feedback se falhar

Garantir qualidade

RubricMiddleware

3: Loop de Eventos (verificação + sistema)

Eventos acionam execuções do agente que atualizam um sistema real

Trabalhar em escala

LangSmith Deployment / Canais do Fleet

4: Loop de Subida de Encosta (sistema + engine)

Traces de produção alimentam um agente de análise que melhora a configuração da arquitetura

Melhoria contínua

LangSmith Engine

Isto é o que a engenharia de loops — ou loopcraft, como @swyx chama — realmente parece na prática. Líderes de IA como Steipete, Boris e Andrej chegaram todos à mesma conclusão: o potencial dos agentes está nos loops que você constrói ao redor deles.

Temos pensado nos loops 1 e 2 por um tempo. Mas o foco deve mudar para os loops 3 e 4, onde o valor se acumula ao incorporar agentes em seu ecossistema que melhoram continuamente em resposta aos seus critérios.

Satya define os stakes organizacionais: empresas que constroem ciclos de aprendizado cedo, onde o julgamento humano e o capital de token se combinam, construirão uma vantagem difícil de replicar.

Agradecimentos

Obrigado a @Vtrivedy10, @masondrxy, @hwchase17 e @huntlovell pela revisão cuidadosa.

Referências

Guardar com um clique

Faça leitura aprofundada de artigos virais com IA no YouMind

Guarde a fonte, faça perguntas específicas, resuma o argumento e transforme um artigo viral em notas reutilizáveis num único espaço de trabalho com IA.

Explorar o YouMind
Para criadores

Transforme o seu Markdown num artigo 𝕏 impecável

Quando publica os seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown num artigo 𝕏 impecável e pronto a publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais