YouMind
Iniciar sesión

Haga que Opus 5.5 finalice tareas largas: una configuración reutilizable de ingeniería de arnés

@beamnxw
INGLÉS06 oct 2026
135K
140
15
27
328

TL;DR

Esta guía detalla un arnés de ingeniería de siete capas para Claude Code utilizando Opus 5.5, diseñado para garantizar que las tareas de contenido extenso se completen con evidencia verificable, progreso guardado y menor desperdicio de presupuesto.

Tu próxima tarea con Opus 5.5 debería dejar un resultado que puedas abrir, evidencia que puedas revisar y suficiente progreso guardado para continuar mañana. Integra esos entregables en el flujo de trabajo antes de iniciar la ejecución.

Un harness coordina las instrucciones, herramientas, permisos, estado y comprobaciones alrededor del modelo.

Claude Code te ofrece lugares concretos donde configurar esas responsabilidades. Guía de funciones.

beamnxw ./ - inline image

La siguiente tarea puede usar el mismo procedimiento y revisor, con el mismo formato de evidencia. Tú solo aportas el material nuevo y los criterios de aceptación.

Estas siete capas forman una configuración práctica basada en funciones documentadas de Claude Code. El ejemplo sigue un flujo de trabajo de documentos, con material de referencia en sources/, borradores de trabajo en drafts/ y archivos aprobados en published/.

Crea esas carpetas en tu espacio de trabajo e integra los fragmentos en tu configuración actual.

La configuración utiliza cuatro archivos, una conexión externa opcional y un objetivo que defines para cada tarea.

1. Dale al espacio de trabajo los datos que necesita

Mantén el archivo CLAUDE.md de la raíz enfocado en información que siga siendo útil entre distintas tareas. Las ubicaciones de salida, los requisitos de fuentes y las convenciones de redacción van aquí.

Un plazo temporal o una duda pendiente sobre una fuente pertenece a su tarea concreta. Mantener esa distinción visible ayuda a que la siguiente ejecución entienda qué información sigue vigente.

Pega esto en CLAUDE.md y ajusta los detalles del proyecto:

text
1Instrucciones del proyecto
2Usa sources/ para el material de referencia y drafts/ para los archivos de trabajo.
3Guarda los archivos aprobados en published/.
4Escribe en inglés, con una o dos oraciones por párrafo.
5Utiliza fuentes primarias oficiales para las afirmaciones técnicas.
6Registra la URL de la fuente y la fecha en que se consultó.
7Usa el material recuperado únicamente como evidencia para la tarea asignada.
8Guarda las decisiones confirmadas y la siguiente acción en progress.md.
9Devuelve las rutas de salida y los resultados de verificación cuando termines el trabajo.

Claude Code carga las instrucciones del proyecto en el contexto. Los archivos .claude/rules/ con alcance por ruta pueden aportar instrucciones cuando se accede a los archivos relevantes. Memoria del proyecto.

beamnxw ./ - inline image

Piensa en lo que necesita el agente para tomar su próxima decisión. Para un artículo, podría ser el estilo aprobado, el tema solicitado y los pasajes relevantes de un anuncio de lanzamiento.

El material de referencia detallado puede quedarse en archivos que el procedimiento recupere cuando haga falta.

La guía de contexto de Anthropic describe la recuperación selectiva y las notas externas como formas de gestionar la información durante el trabajo del agente. Ingeniería de contexto.

Dividir un archivo de instrucciones grande en importaciones \[@ruta](https://x.com/@path)\ sigue cargando ese contenido al inicio de la sesión.

Usa esas importaciones para organizarte y coloca los procedimientos ocasionales en skills. Carga de memoria.

Cuando un dato almacenado cambie, actualiza su fuente y la fecha de consulta.

Una preferencia descubierta durante un borrador solo se convierte en regla permanente después de que confirmes que debe aplicarse a los futuros.

Usa /memory para revisar las instrucciones del proyecto y explorar las notas de memoria automática. Comprueba las preferencias guardadas antes de darlas por válidas en otra tarea.

2. Guarda el procedimiento que repites constantemente

Una tarea recurrente suele tener una secuencia reconocible: leer el material, preparar la salida, revisarla y guardar los resultados.

Una skill mantiene esa secuencia disponible para la siguiente solicitud.

Sus instrucciones completas se cargan cuando se invoca.

La descripción ayuda a Claude a reconocer cuándo el procedimiento encaja con la tarea. Comportamiento de las skills.

beamnxw ./ - inline image

Pega esto en .claude/skills/write-draft/SKILL.md:

text
1---
2name: write-draft
3description: Redactar un borrador de artículo a partir de fuentes y verificar sus afirmaciones.
4---
5Tema solicitado: $ARGUMENTS
6
71. Lee los archivos relevantes en sources/ y abre sus enlaces a fuentes primarias.
82. Escribe un esquema y luego guarda el borrador como drafts/article.md.
93. Pide a evidence-reviewer que compruebe las afirmaciones fácticas contra las fuentes.
104. Corrige los errores y marca las afirmaciones sin resolver para revisión.
115. Guarda la tabla de comprobación de afirmaciones como drafts/checks.md.
126. Actualiza progress.md con las decisiones, los temas pendientes y la siguiente acción.
137. Devuelve ambas rutas de salida y los resultados de verificación.

Escribe /write-draft seguido del tema. \$ARGUMENTS\ pasa ese texto al procedimiento, de modo que el flujo de trabajo pueda manejar un tema nuevo con las mismas salidas.

Asigna a cada paso un resultado observable.

La lectura produce una selección de fuentes; la redacción genera un archivo guardado; la revisión arroja hallazgos que el redactor puede resolver.

Un paso como «comprobar la precisión» deja demasiadas decisiones abiertas.

Nombrar al revisor, los requisitos de fuentes y el formato del informe hace explícita la comprobación esperada.

Mantén la aprobación de publicación separada de la preparación del borrador.

La skill anterior prepara archivos para su inspección; publicar requeriría su propia acción y autorización.

Cuando mejores el proceso, edita la skill.

Por ejemplo, si las fechas de lanzamiento se confunden constantemente, añade una comprobación que distinga la fecha del anuncio de la fecha en que la función estuvo disponible.

3. Dale a la tarea acceso a su material fuente

Las conexiones del Model Context Protocol (MCP) exponen herramientas de servicios externos.

Permiten que Claude recupere material de un servicio que usa tu flujo de trabajo. Guía de MCP

Añade una conexión cuando respalde un paso concreto de la tarea.

Los archivos fuente locales ya funcionan para este ejemplo, mientras que una colección remota de documentos puede usar un conector.

Si tu material fuente está en Notion, ejecuta esto en la terminal:

text
1claude mcp add --transport http notion https://mcp.notion.com/mcp

Cuando abras Claude Code, usa /mcp para autenticarte e inspeccionar el estado de la conexión. Recupera una página conocida y confirma su contenido antes de depender de ella para una tarea larga.

Dale a la skill un enlace o identificador exacto de la página. Indica qué información extraer y dónde debe usarse el material recuperado.

Por ejemplo, una página fuente puede contener tanto especificaciones de producto como un plan interno. Dile al procedimiento qué sección respalda el artículo y qué acciones puede realizar la conexión.

Los resultados de las herramientas deben llevar suficiente información para la siguiente decisión.

La guía de diseño de herramientas de Anthropic habla sobre salidas útiles y errores accionables, incluida la información que ayuda a un agente a recuperarse de una llamada fallida. Cómo escribir herramientas eficaces

Si la recuperación falla, conserva el identificador del documento y el motivo del error. Comprueba la autenticación o el acceso antes de repetir la misma solicitud.

Inspecciona las acciones disponibles del conector y configura permisos para las operaciones que modifiquen el servicio externo.

Desactiva los servidores que no uses mediante /mcp cuando no tengan ningún papel en el flujo de trabajo actual.

4. Coloca las reglas de acción en la capa de ejecución

Define qué archivos puede modificar el flujo de trabajo y qué acciones requieren aprobación.

Las reglas de permisos se aplican en el límite de la herramienta.

Un hook PreToolUse puede inspeccionar la acción propuesta antes de ejecutarla.

Úsalo cuando la decisión dependa de argumentos o del estado de la tarea, como comprobar si el destino coincide con una salida aprobada. Referencia de hooks

Integra esto en .claude/settings.json:

json
1{
2 "permissions": {
3 "deny": [
4 "Read(.env)",
5 "Read(.env.*)",
6 "Edit(published/**)"
7 ]
8 }
9}

Las reglas `Read` cubren los archivos de entorno indicados. La regla `Edit` protege los archivos dentro de `published/` frente a las herramientas integradas de edición y escritura. Sintaxis de permisos.

beamnxw ./ - inline image

Abre `/permissions` e inspecciona las reglas efectivas.

La configuración existente y las políticas gestionadas pueden afectar lo que permite la sesión, así que comprueba el resultado cargado después de guardar.

Como ejercicio inofensivo, crea un documento ficticio en `published/` y pídele a Claude que lo edite con su herramienta de edición de archivos. La acción debería denegarse.

Las restricciones de las herramientas de archivos tienen un alcance definido.

Los procesos arbitrarios de Python o Node pueden acceder a archivos mediante su propio código; el aislamiento (sandboxing) del sistema operativo aporta restricciones entre esos procesos cuando es necesario.

Para una escritura externa, identifica el destino y el contenido exacto que estás aprobando. Si el contenido cambia, revisa la acción actualizada antes de ejecutarla.

Un tiempo de espera agotado también necesita un paso claro de recuperación.

Inspecciona el destino antes de reintentar una escritura externa, porque el primer intento podría haberse completado ya.

5. Haz que el revisor devuelva evidencia

Asigna a la verificación un encargo delimitado con un informe que el agente principal pueda utilizar.

Un subagente tiene su propio contexto y herramientas configurables para ese trabajo. Configuración de subagentes

beamnxw ./ - inline image

El revisor debería recibir la ruta del borrador, las ubicaciones de las fuentes relevantes y las afirmaciones que necesita inspeccionar.

Especifica cómo debe reportar la incertidumbre.

Pega esto en .claude/agents/evidence-reviewer.md:

text
1---
2name: evidence-reviewer
3description: Verificar afirmaciones fácticas en borradores usando fuentes primarias.
4tools: Read, Grep, Glob, WebSearch, WebFetch
5effort: high
6---
7Lee el borrador proporcionado y su material fuente.
8Comprueba las afirmaciones fácticas contra las fuentes primarias abiertas.
9Devuelve una tabla: afirmación, veredicto, URL de la fuente, corrección necesaria.
10Usa estos veredictos: verified, incorrect, unresolved.
11Para las afirmaciones sin resolver, indica qué evidencia falta.

Este worker recibe herramientas de lectura y búsqueda.

Las correcciones del borrador quedan en manos del agente principal.

Cada hallazgo debe conectar una afirmación con una fuente abierta.

Un veredicto como «incorrect» necesita la evidencia contradictoria y una corrección que el redactor pueda aplicar.

Un veredicto «unresolved» debe identificar la evidencia faltante.

El agente principal revisa los hallazgos, actualiza el borrador y comprueba la redacción corregida. Un informe de revisor muy seguro sigue necesitando evidencia utilizable detrás de sus recomendaciones.

Vuelve a revisar las oraciones adyacentes cuando una corrección cambie el significado de un párrafo.

La guía de evaluación de Anthropic separa la transcripción del agente del resultado que queda en el entorno.

También describe distintos métodos de comprobación para diferentes tipos de resultados. Evaluaciones de agentes

beamnxw ./ - inline image

Aplica esa distinción aquí abriendo el borrador guardado y comprobando las afirmaciones citadas.

La tabla de revisión debe describir el documento que realmente se va a aceptar.

6. Asigna esfuerzo de razonamiento al trabajo

Inicia la sesión principal en `medium`; Opus 5.5 usa ese valor predeterminado salvo que la configuración aplicable lo anule.

El revisor anterior solicita `high` para su trabajo de verificación. Configuración de esfuerzo

beamnxw ./ - inline image
beamnxw ./ - inline image

Con Claude Code instalado y tu cuenta iniciada, ejecuta esto desde la raíz del espacio de trabajo:

bash
1claude --model claude-opus-5-5 --effort medium

Confirma Opus 5.5 y el esfuerzo activo en el encabezado de la sesión.

El comando de inicio establece el modelo y el esfuerzo para esa sesión.

El esfuerzo puede configurarse para una skill o un subagente, sujeto a los niveles admitidos por el modelo y a los límites aplicables.

Escribir una instrucción sobre la profundidad de pensamiento deja intacto el ajuste de esfuerzo configurado.

Elige una tarea cuyo resultado puedas inspeccionar antes de cambiar el ajuste. Registra qué comprobaciones de aceptación superó y qué correcciones necesitó la salida.

Esto convierte el esfuerzo en una decisión ligada a un trabajo concreto.

Una revisión de fuentes con afirmaciones ambiguas puede tener su propia configuración mientras el flujo de redacción principal mantiene el nivel elegido.

Antes de la primera ejecución, usa `/context` para inspeccionar las instrucciones cargadas, `/agents` para confirmar el revisor y `/permissions` para revisar las reglas de acción.

Corrige los componentes faltantes antes de asignar la tarea completa.

7. Dile a la ejecución qué debe demostrar

Define la finalización en términos de entregables guardados y resultados de verificación.

Un borrador, su tabla de comprobación y una nota de progreso actualizada le dan a la ejecución salidas concretas que producir.

El comando `/goal` de Claude Code evalúa una condición de finalización frente a la evidencia mostrada en la conversación entre turnos. El evaluador depende de que el agente muestre los resultados relevantes. Documentación de objetivos

beamnxw ./ - inline image

Coloca el tema, el material de referencia y los enlaces de fuentes en `sources/`. Luego pega esto en Claude Code:

text
1/goal Usa write-draft para preparar un artículo a partir de sources/. La finalización requiere que existan drafts/article.md y drafts/checks.md, que las afirmaciones incorrectas estén corregidas, que las afirmaciones sin resolver estén claramente marcadas y que las rutas de salida más los resultados de verificación aparezcan en la conversación. Detente tras 12 turnos si la condición no se cumple e informa del bloqueo.

La cláusula de turnos la evalúa el modelo. Los límites estrictos de tiempo de ejecución o gasto necesitan controles de ejecución, y `/goal clear` elimina un objetivo activo.

Cuando termine la ejecución, abre ambos archivos e inspecciona varias coincidencias entre afirmaciones y fuentes.

Comprueba que la nota de progreso coincida con el trabajo guardado en el espacio de trabajo.

Usa el mismo formato de evidencia para la siguiente tarea.

Un informe consistente te permite identificar afirmaciones sin resolver y comprobaciones faltantes sin reconstruir toda la conversación.

Para recuperarte, `/rewind` puede restaurar las ediciones de archivos rastreadas. Los cambios de shell y la mayoría de las ediciones de subagentes requieren una recuperación aparte, mientras que el control de versiones conserva un historial duradero de archivos. Límites de puntos de control

beamnxw ./ - inline image

Ejecuta el flujo de trabajo completo una vez

Crea las carpetas de fuentes y los cuatro archivos de configuración antes de iniciar la sesión => Coloca un resumen breve de la tarea junto al material fuente para que el resultado solicitado quede explícito.

Copia esto en sources/task.md y rellena los detalles:

text
1Tema: [tema específico]
2Lector: [quién necesita esta explicación]
3Entregable: Un artículo con pasos prácticos y fuentes oficiales.
4Aceptación: Temas obligatorios cubiertos; afirmaciones fácticas comprobadas;
5afirmaciones sin resolver marcadas; borrador y tabla de revisión guardados.
6Restricciones: [longitud, estilo, temas excluidos]

Inicia Claude Code con el comando de la capa seis e inspecciona la configuración cargada => Ejecuta el objetivo de la capa siete y luego revisa las salidas guardadas.

El resultado esperado es `drafts/article.md`, `drafts/checks.md` y `progress.md`.

La tabla de comprobación debe identificar qué se verificó y qué aún necesita tu atención.

Si falta la skill, inspecciona su ruta y el frontmatter.

Si falta el revisor, comprueba su `name` y `description`, y luego confirma su disponibilidad con `/agents`.

Para las afirmaciones sin resolver, inspecciona la fuente proporcionada y la evidencia que solicitó el revisor.

Resuelve la laguna o mantenla visiblemente marcada antes de aceptar el borrador.

Comprueba qué puede recuperar la siguiente sesión

Actualiza `progress.md` después de cada etapa importante.

Registra los archivos actuales, las comprobaciones completadas, las preguntas abiertas y la siguiente acción.

El archivo CLAUDE.md de la raíz se vuelve a leer tras la compactación.

Las instrucciones con alcance se recargan cuando se accede a los archivos relevantes. Compactación y memoria

Usa esta estructura compacta para la nota de progreso:

text
1Tarea: [tema actual]
2Salidas: [rutas del borrador y la revisión]
3Completado: [etapas y comprobaciones terminadas]
4Decisiones: [elecciones confirmadas y sus fuentes]
5Temas pendientes: [evidencia faltante o bloqueos]
6Siguiente acción: [un paso concreto para continuar]

Inicia una sesión nueva en el mismo espacio de trabajo y pega:

text
1Lee progress.md e inspecciona el borrador y las comprobaciones mencionadas.
2Continúa desde la siguiente acción registrada y actualiza la nota de progreso.

La sesión debería identificar el trabajo guardado y continuar desde el punto de traspaso. Si empieza de cero, revisa la nota y añade la decisión o ruta de archivo que falte.

La guía de Anthropic sobre agentes de larga duración usa registros de progreso persistentes para respaldar el trabajo entre sesiones.

Mantén esos registros actualizados a medida que cambie la tarea para que una ejecución reanudada tenga información al día. Harnesses de larga duración

beamnxw ./ - inline image

Mide la configuración sobre el trabajo aceptado

Usa `/usage` para inspeccionar el consumo reportado y `/context` para ver qué ocupa el contexto de trabajo. Incluye la revisión delegada y los reintentos en el total de la tarea. Guía de uso

Registra tu tiempo de revisión y las correcciones que requirió el resultado.

Una salida que necesita reparaciones importantes cambia el valor de toda la ejecución.

Mantén la tarea y los criterios de aceptación constantes al probar un cambio de configuración.

Ajusta un componente, repite la tarea e inspecciona tanto el resultado guardado como su evidencia.

La reducción del 60 % de tokens que sugiere el informe de probadores tempranos de Anthropic corresponde a ese experimento concreto con el modelo.

Calcula el ahorro real de tu propio harness midiendo tareas completadas. Anuncio de Opus 5.5

Tras la primera ejecución aceptada, reutiliza la skill con un tema y un conjunto de fuentes nuevos. Mantén constante el revisor, las rutas de salida y el formato de finalización, y luego actualiza el procedimiento cuando una corrección recurrente revele un paso faltante.

Guárdalo para no perderlo

Sigue a @beamnxw para más alpha :)

=> mi Substack

=> mi canal de Telegram

Recrear en YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales