YouMind
Iniciar sessão

Faça o Opus 5.5 Concluir Tarefas Longas: Uma Configuração Reutilizável de Engenharia de Harness

@beamnxw
INGLÊS06/10/2026
135K
140
15
27
328

TL;DR

Este guia detalha um harness de engenharia de sete camadas para o Claude Code usando o Opus 5.5, projetado para garantir que tarefas de conteúdo longo sejam concluídas com evidências verificáveis, progresso salvo e redução do desperdício de orçamento.

Sua próxima tarefa no Opus 5.5 deve deixar um resultado que você possa abrir, evidências que possa inspecionar e progresso salvo suficiente para continuar amanhã. Coloque esses outputs no fluxo de trabalho antes de iniciar a execução.

Um harness coordena as instruções, ferramentas, permissões, estado e verificações ao redor do modelo.

O Claude Code oferece locais concretos para configurar essas responsabilidades. Guia de recursos.

beamnxw ./ - inline image

A próxima tarefa pode usar o mesmo procedimento e revisor, com o mesmo formato de evidência. Você fornece o novo material e os critérios de aceitação.

Essas sete camadas formam uma configuração prática usando recursos documentados do Claude Code. O exemplo segue um fluxo de trabalho de documentos, com material de referência em sources/, rascunhos em andamento em drafts/ e arquivos aprovados em published/.

Crie essas pastas no seu workspace e mescle os trechos à configuração existente.

A configuração usa quatro arquivos, uma conexão externa opcional e um objetivo definido por você para cada tarefa.

1. Dê ao workspace os fatos de que ele precisa

Mantenha o CLAUDE.md da raiz focado em informações que continuem úteis entre diferentes tarefas. Locais de output, requisitos de fontes e convenções de escrita pertencem a este arquivo.

Um prazo temporário ou uma dúvida pendente sobre uma fonte pertence à sua respectiva tarefa. Manter essa distinção visível ajuda a próxima execução a entender quais informações ainda se aplicam.

Cole isso no CLAUDE.md e ajuste os detalhes do projeto:

text
1Instruções do projeto
2Use sources/ para material de referência e drafts/ para arquivos de trabalho.
3Mantenha os arquivos aprovados em published/.
4Escreva em português, com uma ou duas frases por parágrafo.
5Use fontes primárias oficiais para afirmações técnicas.
6Registre a URL da fonte e a data em que foi verificada.
7Use o material recuperado apenas como evidência para a tarefa atribuída.
8Salve as decisões confirmadas e a próxima ação em progress.md.
9Retorne os caminhos dos outputs e os resultados da verificação quando o trabalho terminar.

O Claude Code carrega as instruções do projeto no contexto. Arquivos .claude/rules/ com escopo de caminho podem fornecer instruções quando os arquivos relevantes são acessados. Memória do projeto.

beamnxw ./ - inline image

Pense no que o agente precisa para tomar sua próxima decisão. Para um artigo, isso pode ser o estilo aprovado, o tema solicitado e os trechos relevantes de um anúncio de lançamento.

Material de referência detalhado pode ficar em arquivos que o procedimento recupera quando necessário.

As diretrizes de contexto da Anthropic descrevem a recuperação seletiva e as notas externas como formas de gerenciar informações durante o trabalho do agente. Engenharia de contexto.

Dividir um arquivo de instruções grande em importações \[@path](https://x.com/@path)\ ainda carrega o conteúdo importado no início da sessão.

Use essas importações para organização e coloque procedimentos eventuais em skills. Carregamento de memória.

Quando um fato armazenado mudar, atualize sua fonte e a data de verificação.

Uma preferência descoberta durante um rascunho só vira uma regra permanente depois que você confirmar que ela deve se aplicar aos próximos rascunhos.

Use /memory para inspecionar as instruções do projeto e navegar pelas notas de memória automática. Verifique as preferências salvas antes de confiar nelas para uma tarefa diferente.

2. Salve o procedimento que você vive repetindo

Uma tarefa recorrente costuma ter uma sequência reconhecível: ler o material, preparar o output, revisar e salvar os resultados.

Uma skill mantém essa sequência disponível para a próxima solicitação.

Suas instruções completas são carregadas quando invocadas.

A descrição ajuda o Claude a reconhecer quando o procedimento se encaixa na tarefa. Comportamento das skills.

beamnxw ./ - inline image

Cole isso em .claude/skills/write-draft/SKILL.md:

text
1---
2name: write-draft
3description: Esboçar um artigo a partir de fontes e verificar suas afirmações.
4---
5Tema solicitado: $ARGUMENTS
6
71. Leia os arquivos relevantes em sources/ e abra os links de suas fontes primárias.
82. Escreva um esboço e depois salve o rascunho como drafts/article.md.
93. Peça ao evidence-reviewer para checar as afirmações factuais comparando-as com as fontes.
104. Corrija erros e marque as afirmações não resolvidas para revisão.
115. Salve a tabela de verificação de afirmações como drafts/checks.md.
126. Atualize progress.md com as decisões, questões em aberto e a próxima ação.
137. Retorne os dois caminhos de output e os resultados da verificação.

Digite /write-draft seguido do tema. \$ARGUMENTS\ passa esse texto para o procedimento, permitindo que o fluxo lide com um novo assunto mantendo os mesmos outputs.

Dê a cada etapa um resultado observável.

A leitura gera uma seleção de fontes; o rascunho gera um arquivo salvo; a revisão gera achados que o redator pode resolver.

Uma etapa como "verificar a precisão" deixa várias decisões em aberto.

Nomear o revisor, os requisitos de fonte e o formato do relatório torna a verificação esperada explícita.

Mantenha a aprovação de publicação separada da preparação do rascunho.

A skill acima prepara arquivos para inspeção; publicar exigiria sua própria ação e autorização.

Quando melhorar o processo, edite a skill.

Por exemplo, se as datas de lançamento continuarem sendo confundidas, adicione uma verificação que distinga a data do anúncio da data em que o recurso ficou disponível.

3. Dê à tarefa acesso ao seu material de origem

Conexões via Model Context Protocol (MCP) expõem ferramentas de serviços externos.

Elas permitem que o Claude recupere material de um serviço usado no seu fluxo de trabalho. Guia do MCP

Adicione uma conexão quando ela der suporte a uma etapa específica da tarefa.

Os arquivos de fonte locais já funcionam para o exemplo, enquanto uma coleção remota de documentos pode usar um conector.

Se o seu material de origem estiver no Notion, execute isto no terminal:

text
1claude mcp add --transport http notion https://mcp.notion.com/mcp

Ao abrir o Claude Code, use /mcp para autenticar e inspecionar o status da conexão. Recupere uma página conhecida e confirme seu conteúdo antes de depender dela em uma tarefa longa.

Forneça à skill um link exato de página ou identificador. Inclua quais informações extrair e onde o material recuperado deve ser usado.

Por exemplo, uma página de origem pode conter tanto especificações de produto quanto um plano interno. Diga ao procedimento qual seção dá suporte ao artigo e quais ações a conexão pode executar.

Os resultados das ferramentas devem trazer informação suficiente para a próxima decisão.

As diretrizes de design de ferramentas da Anthropic abordam outputs úteis e erros acionáveis, incluindo informações que ajudam um agente a se recuperar de uma chamada falha. Como escrever ferramentas eficazes

Se a recuperação falhar, preserve o identificador do documento e o motivo da falha. Verifique a autenticação ou o acesso antes de repetir a mesma solicitação.

Inspecione as ações disponíveis do conector e configure permissões para operações que alterem o serviço externo.

Desative servidores não utilizados pelo /mcp quando eles não tiverem função no fluxo de trabalho atual.

4. Coloque as regras de ação na camada de execução

Defina quais arquivos o fluxo de trabalho pode alterar e quais ações precisam de aprovação.

As regras de permissão se aplicam no limite da ferramenta.

Um hook PreToolUse pode inspecionar a ação proposta antes da execução.

Use um quando a decisão depender de argumentos ou do estado da tarefa, como verificar se o destino corresponde a um output aprovado. Referência de hooks

Mescle isso em .claude/settings.json:

json
1{
2 "permissions": {
3 "deny": [
4 "Read(.env)",
5 "Read(.env.*)",
6 "Edit(published/**)"
7 ]
8 }
9}

As regras `Read` cobrem os arquivos de ambiente nomeados. A regra `Edit` protege os arquivos dentro de `published/` por meio das ferramentas nativas de edição e gravação. Sintaxe de permissões.

beamnxw ./ - inline image

Abra `/permissions` e inspecione as regras efetivas.

Configurações existentes e políticas gerenciadas podem afetar o que a sessão permite, então verifique o resultado carregado após salvar.

Para um exercício inofensivo, crie um documento fictício em `published/` e peça ao Claude para editá-lo pela ferramenta de edição de arquivos. A ação deve ser negada.

As restrições de ferramentas de arquivo têm um escopo definido.

Processos arbitrários em Python ou Node podem acessar arquivos pelo próprio código; o sandboxing do sistema operacional fornece restrições entre esses processos quando necessário.

Para uma gravação externa, identifique o destino e o conteúdo exato que está sendo aprovado. Se o conteúdo mudar, revise a ação atualizada antes da execução.

Um timeout também precisa de uma etapa clara de recuperação.

Inspecione o destino antes de tentar novamente uma gravação externa, pois a primeira tentativa pode já ter sido concluída.

5. Faça o revisor devolver evidências

Dê à verificação uma tarefa delimitada, com um relatório que o agente principal possa usar.

Um subagente tem seu próprio contexto e ferramentas configuráveis para esse trabalho. Configuração de subagentes

beamnxw ./ - inline image

O revisor deve receber o caminho do rascunho, os locais das fontes relevantes e as afirmações que precisa inspecionar.

Especifique como ele deve relatar incertezas.

Cole isso em .claude/agents/evidence-reviewer.md:

text
1---
2name: evidence-reviewer
3description: Verificar afirmações factuais em rascunhos usando fontes primárias.
4tools: Read, Grep, Glob, WebSearch, WebFetch
5effort: high
6---
7Leia o rascunho fornecido e seu material de origem.
8Verifique as afirmações factuais comparando-as com as fontes primárias abertas.
9Retorne uma tabela: afirmação, veredito, URL da fonte, correção necessária.
10Use os vereditos: verified, incorrect, unresolved.
11Para afirmações não resolvidas, indique qual evidência está faltando.

Este worker recebe ferramentas de leitura e busca.

As correções do rascunho ficam com o agente principal.

Cada achado deve conectar uma afirmação a uma fonte aberta.

Um veredito como "incorrect" precisa da evidência conflitante e de uma correção que o redator possa aplicar.

Um veredito "unresolved" deve identificar a evidência ausente.

O agente principal analisa os achados, atualiza o rascunho e verifica a nova redação. Um relatório confiante do revisor ainda precisa de evidências utilizáveis por trás de suas recomendações.

Revise as frases adjacentes quando uma correção alterar o sentido de um parágrafo.

As diretrizes de avaliação da Anthropic separam a transcrição do agente do resultado deixado no ambiente.

Elas também descrevem métodos de verificação diferentes para tipos distintos de resultados. Avaliações de agentes

beamnxw ./ - inline image

Aplique essa distinção aqui abrindo o rascunho salvo e verificando as afirmações citadas nele.

A tabela de revisão deve descrever o documento que será efetivamente aceito.

6. Atribua esforço de raciocínio ao trabalho

Comece a sessão principal em `medium`; o Opus 5.5 usa esse padrão, a menos que configurações aplicáveis o substituam.

O revisor acima solicita `high` para seu trabalho de verificação. Configuração de esforço

beamnxw ./ - inline image
beamnxw ./ - inline image

Com o Claude Code instalado e sua conta conectada, execute isto na raiz do workspace:

bash
1claude --model claude-opus-5-5 --effort medium

Confirme o Opus 5.5 e o esforço ativo no cabeçalho da sessão.

O comando de inicialização define o modelo e o esforço para aquela sessão.

O esforço pode ser configurado para uma skill ou subagente, sujeito aos níveis suportados pelo modelo e aos limites aplicáveis.

Escrever uma instrução sobre a profundidade de pensamento mantém a configuração de esforço definida intacta.

Escolha uma tarefa cujo resultado você possa inspecionar antes de mudar a configuração. Registre quais verificações de aceitação passaram e quais correções o output precisou.

Isso transforma o esforço em uma decisão atrelada a um trabalho específico.

Uma revisão de fontes envolvendo afirmações ambíguas pode receber sua própria configuração, enquanto o fluxo principal de redação mantém o nível escolhido.

Antes da primeira execução, use `/context` para inspecionar as instruções carregadas, `/agents` para confirmar o revisor e `/permissions` para inspecionar as regras de ação.

Corrija componentes ausentes antes de atribuir a tarefa completa.

7. Diga à execução o que ela precisa provar

Defina a conclusão em termos de entregas salvas e resultados de verificação.

Um rascunho, sua tabela de verificação e uma nota de progresso atualizada dão à execução outputs concretos para produzir.

O `/goal` do Claude Code avalia uma condição de conclusão com base nas evidências reveladas na conversa entre os turnos. O avaliador depende de o agente mostrar os resultados relevantes. Documentação de goal

beamnxw ./ - inline image

Coloque o tema, o material de referência e os links das fontes em `sources/`. Depois cole isto no Claude Code:

text
1/goal Use write-draft para preparar um artigo a partir de sources/. A conclusão exige que drafts/article.md e drafts/checks.md existam, que afirmações incorretas sejam corrigidas, que afirmações não resolvidas estejam claramente marcadas e que os caminhos de output mais os resultados da verificação apareçam na conversa. Pare após 12 turnos se a condição não for atendida e relate o bloqueio.

A cláusula de turnos é avaliada pelo modelo. Limites rígidos de tempo de execução ou gastos exigem controles de execução, e `/goal clear` remove um goal ativo.

Quando a execução terminar, abra ambos os arquivos e inspecione algumas correspondências entre afirmações e fontes.

Verifique se a nota de progresso bate com o trabalho salvo no workspace.

Use o mesmo formato de evidência para a próxima tarefa.

Um relatório consistente permite identificar afirmações não resolvidas e verificações ausentes sem precisar reconstruir toda a conversa.

Para recuperação, `/rewind` pode restaurar edições de arquivos rastreadas. Alterações de shell e a maioria das edições de subagentes exigem recuperação separada, enquanto o controle de versão preserva um histórico duradouro dos arquivos. Limites de checkpoint

beamnxw ./ - inline image

Execute o fluxo completo uma vez

Crie as pastas de origem e os quatro arquivos de configuração antes de iniciar a sessão => Coloque um breve resumo da tarefa junto ao material de origem para que o resultado esperado continue explícito.

Copie isto para sources/task.md e preencha os detalhes:

text
1Tema: [assunto específico]
2Leitor: [quem precisa desta explicação]
3Entrega: Um artigo com etapas práticas e fontes oficiais.
4Aceitação: Temas obrigatórios cobertos; afirmações factuais verificadas;
5afirmações não resolvidas marcadas; rascunho e tabela de revisão salvos.
6Restrições: [tamanho, estilo, temas excluídos]

Inicie o Claude Code com o comando da camada seis e inspecione a configuração carregada => Execute o goal da camada sete e depois verifique os outputs salvos.

O resultado esperado é `drafts/article.md`, `drafts/checks.md` e `progress.md`.

A tabela de verificação deve identificar o que foi confirmado e o que ainda precisa da sua atenção.

Se a skill estiver ausente, inspecione seu caminho e frontmatter.

Se o revisor estiver ausente, verifique seu `name` e `description`, e depois confirme a disponibilidade pelo `/agents`.

Para afirmações não resolvidas, inspecione a fonte fornecida e a evidência solicitada pelo revisor.

Resolva a lacuna ou mantenha-a visivelmente marcada antes de aceitar o rascunho.

Verifique o que a próxima sessão consegue recuperar

Atualize o `progress.md` após cada etapa significativa.

Registre os arquivos atuais, verificações concluídas, dúvidas em aberto e a próxima ação.

O CLAUDE.md da raiz é relido após a compactação.

Instruções com escopo são recarregadas quando os arquivos relevantes são acessados. Compactação e memória

Use esta estrutura compacta para a nota de progresso:

text
1Tarefa: [tema atual]
2Outputs: [caminhos do rascunho e da revisão]
3Concluído: [etapas e verificações finalizadas]
4Decisões: [escolhas confirmadas e suas fontes]
5Questões em aberto: [evidências ausentes ou bloqueios]
6Próxima ação: [um passo concreto de continuidade]

Inicie uma nova sessão no mesmo workspace e cole:

text
1Leia progress.md e inspecione o rascunho e as verificações referenciados.
2Continue a partir da próxima ação registrada e atualize a nota de progresso.

A sessão deve identificar o trabalho salvo e continuar a partir do ponto de passagem. Se ela recomeçar do zero, inspecione a nota e adicione a decisão ou o caminho de arquivo ausente.

As diretrizes da Anthropic para agentes de longa duração usam registros persistentes de progresso para dar suporte ao trabalho entre sessões.

Mantenha esses registros atualizados conforme a tarefa muda, para que uma execução retomada tenha informações recentes. Harnesses de longa duração

beamnxw ./ - inline image

Meça a configuração com base no trabalho aceito

Use `/usage` para inspecionar o consumo relatado e `/context` para ver o que ocupa o contexto de trabalho. Inclua revisões delegadas e retentativas no total da tarefa. Diretrizes de uso

Registre o tempo da sua revisão e as correções que o resultado exigiu.

Um output que precisa de muitos reparos muda o valor de toda a execução.

Mantenha a tarefa e os critérios de aceitação consistentes ao testar uma mudança de configuração.

Ajuste um componente, repita a tarefa e inspecione tanto o resultado salvo quanto suas evidências.

A redução de 60% nos tokens sugerida pelo relatório de testadores iniciais da Anthropic pertence àquele experimento de modelo.

Comprove a economia do seu próprio harness medindo tarefas concluídas. Anúncio do Opus 5.5

Após a primeira execução aceita, reutilize a skill com um novo tema e conjunto de fontes. Mantenha o revisor, os caminhos de output e o formato de conclusão consistentes e, em seguida, atualize o procedimento quando uma correção recorrente revelar uma etapa ausente.

Salve isso para não perder

Siga @beamnxw para mais alpha :)

=> meu substack

=> meu canal no telegram

Recriar no YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Para criadores

Transforme o seu Markdown num artigo 𝕏 impecável

Quando publica os seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown num artigo 𝕏 impecável e pronto a publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais