YouMind
Iniciar sesión

Haz que Opus 5.5 complete tareas largas: una configuración reutilizable de ingeniería de arnés

@beamnxw
INGLÉS06 oct 2026
135K
140
15
27
328

TL;DR

Esta guía detalla un arnés de ingeniería de siete capas para Claude Code utilizando Opus 5.5, diseñado para garantizar que las tareas de contenido extenso se completen con evidencia verificable, progreso guardado y menor desperdicio de presupuesto.

Tu próxima tarea con Opus 5.5 debería dejar un resultado que puedas abrir, evidencia que puedas revisar y suficiente progreso guardado para continuar mañana. Integra esos entregables en el flujo de trabajo antes de iniciar la ejecución.

Un harness coordina las instrucciones, herramientas, permisos, estado y verificaciones alrededor del modelo.

Claude Code te ofrece espacios concretos para configurar esas responsabilidades. Guía de funciones.

beamnxw ./ - inline image

La siguiente tarea puede usar el mismo procedimiento y revisor, con el mismo formato de evidencia. Tú solo aportas material nuevo y criterios de aceptación.

Estas siete capas forman una configuración práctica usando funciones documentadas de Claude Code. El ejemplo sigue un flujo de trabajo de documentos, con material de referencia en sources/, borradores de trabajo en drafts/ y archivos aprobados en published/.

Crea esas carpetas en tu espacio de trabajo e integra los fragmentos a tu configuración existente.

La configuración usa cuatro archivos, una conexión externa opcional y un objetivo que defines para cada tarea.

1. Dale al espacio de trabajo los datos que necesita

Mantén el archivo CLAUDE.md de la raíz enfocado en información que siga siendo útil entre distintas tareas. Las ubicaciones de salida, los requisitos de fuentes y las convenciones de redacción van aquí.

Una fecha límite temporal o una duda pendiente sobre una fuente pertenece a su tarea específica. Mantener esa distinción visible ayuda a que la próxima ejecución entienda qué información sigue aplicando.

Pega esto en CLAUDE.md y ajusta los detalles del proyecto:

text
1Instrucciones del proyecto
2Usa sources/ para el material de referencia y drafts/ para los archivos de trabajo.
3Guarda los archivos aprobados en published/.
4Escribe en inglés, con una o dos oraciones por párrafo.
5Usa fuentes primarias oficiales para las afirmaciones técnicas.
6Registra la URL de la fuente y la fecha en que se verificó.
7Usa el material recuperado solo como evidencia para la tarea asignada.
8Guarda las decisiones confirmadas y el siguiente paso en progress.md.
9Devuelve las rutas de salida y los resultados de verificación cuando termines el trabajo.

Claude Code carga las instrucciones del proyecto en el contexto. Los archivos .claude/rules/ con alcance por ruta pueden aportar instrucciones cuando se accede a los archivos relevantes. Memoria del proyecto.

beamnxw ./ - inline image

Piensa en lo que el agente necesita para tomar su próxima decisión. Para un artículo, podría ser el estilo aprobado, el tema solicitado y los pasajes relevantes de un anuncio de lanzamiento.

El material de referencia detallado puede quedarse en archivos que el procedimiento recupere cuando sea necesario.

La guía de contexto de Anthropic describe la recuperación selectiva y las notas externas como formas de gestionar la información durante el trabajo del agente. Ingeniería de contexto.

Dividir un archivo de instrucciones grande en importaciones \[@ruta](https://x.com/@path)\ igual carga el contenido importado al inicio de la sesión.

Usa esas importaciones para organizarte y coloca los procedimientos ocasionales en skills. Carga de memoria.

Cuando un dato guardado cambie, actualiza su fuente y la fecha de verificación.

Una preferencia descubierta durante un borrador solo se convierte en regla permanente después de que confirmes que debe aplicar a los borradores futuros.

Usa /memory para inspeccionar las instrucciones del proyecto y explorar las notas de memoria automática. Revisa las preferencias guardadas antes de depender de ellas para otra tarea.

2. Guarda el procedimiento que repites siempre

Una tarea recurrente suele tener una secuencia reconocible: leer el material, preparar el entregable, revisarlo y guardar los resultados.

Un skill mantiene esa secuencia disponible para la próxima solicitud.

Sus instrucciones completas se cargan cuando se invoca.

La descripción ayuda a Claude a reconocer cuándo el procedimiento encaja con la tarea. Comportamiento de skills.

beamnxw ./ - inline image

Pega esto en .claude/skills/write-draft/SKILL.md:

text
1---
2name: write-draft
3description: Redactar un borrador de artículo a partir de fuentes y verificar sus afirmaciones.
4---
5Tema solicitado: $ARGUMENTS
6
71. Lee los archivos relevantes en sources/ y abre sus enlaces a fuentes primarias.
82. Escribe un esquema y luego guarda el borrador como drafts/article.md.
93. Pídele a evidence-reviewer que verifique las afirmaciones fácticas contra las fuentes.
104. Corrige los errores y marca las afirmaciones sin resolver para revisión.
115. Guarda la tabla de verificación de afirmaciones como drafts/checks.md.
126. Actualiza progress.md con las decisiones, los temas pendientes y el siguiente paso.
137. Devuelve ambas rutas de salida y los resultados de verificación.

Escribe /write-draft seguido del tema. \$ARGUMENTS\ pasa ese texto al procedimiento, para que el flujo de trabajo pueda manejar un tema nuevo con los mismos entregables.

Dale a cada paso un resultado observable.

Leer genera una selección de fuentes; redactar genera un archivo guardado; revisar genera hallazgos que el autor puede resolver.

Un paso como "verificar precisión" deja varias decisiones abiertas.

Nombrar al revisor, los requisitos de fuentes y el formato del reporte hace explícita la verificación esperada.

Mantén la aprobación de publicación separada de la preparación del borrador.

El skill anterior prepara archivos para inspección; publicar requeriría su propia acción y autorización.

Cuando mejores el proceso, edita el skill.

Por ejemplo, si las fechas de lanzamiento se confunden seguido, agrega una verificación que distinga la fecha de anuncio de la fecha en que una función estuvo disponible.

3. Dale a la tarea acceso a su material fuente

Las conexiones del Model Context Protocol (MCP) exponen herramientas de servicios externos.

Permiten que Claude recupere material de un servicio que usa tu flujo de trabajo. Guía de MCP

Agrega una conexión cuando respalde un paso específico de la tarea.

Los archivos fuente locales ya funcionan para el ejemplo, mientras que una colección remota de documentos puede usar un conector.

Si tu material fuente está en Notion, ejecuta esto en la terminal:

text
1claude mcp add --transport http notion https://mcp.notion.com/mcp

Cuando abras Claude Code, usa /mcp para autenticarte e inspeccionar el estado de la conexión. Recupera una página conocida y confirma su contenido antes de depender de ella para una tarea larga.

Dale al skill un enlace o identificador exacto de la página. Incluye qué información extraer y dónde debe usarse el material recuperado.

Por ejemplo, una página fuente puede contener tanto especificaciones de producto como un plan interno. Dile al procedimiento qué sección respalda el artículo y qué acciones puede realizar la conexión.

Los resultados de las herramientas deben llevar suficiente información para la próxima decisión.

La guía de diseño de herramientas de Anthropic habla sobre salidas útiles y errores accionables, incluida la información que ayuda a un agente a recuperarse de una llamada fallida. Cómo escribir herramientas efectivas

Si la recuperación falla, conserva el identificador del documento y el motivo del error. Verifica la autenticación o el acceso antes de repetir la misma solicitud.

Inspecciona las acciones disponibles del conector y configura permisos para las operaciones que modifiquen el servicio externo.

Desactiva los servidores que no uses mediante /mcp cuando no tengan ningún rol en el flujo de trabajo actual.

4. Pon las reglas de acción en la capa de ejecución

Define qué archivos puede modificar el flujo de trabajo y qué acciones requieren aprobación.

Las reglas de permisos se aplican en el límite de la herramienta.

Un hook PreToolUse puede inspeccionar la acción propuesta antes de ejecutarla.

Úsalo cuando la decisión dependa de argumentos o del estado de la tarea, como si el destino coincide con una salida aprobada. Referencia de hooks

Integra esto en .claude/settings.json:

json
1{
2 "permissions": {
3 "deny": [
4 "Read(.env)",
5 "Read(.env.*)",
6 "Edit(published/**)"
7 ]
8 }
9}

Las reglas de `Read` cubren los archivos de entorno mencionados. La regla de `Edit` protege los archivos dentro de `published/` frente a las herramientas integradas de edición y escritura. Sintaxis de permisos.

beamnxw ./ - inline image

Abre `/permissions` e inspecciona las reglas efectivas.

La configuración existente y las políticas administradas pueden afectar lo que permite la sesión, así que revisa el resultado cargado después de guardar.

Como ejercicio inofensivo, crea un documento falso en `published/` y pídele a Claude que lo edite con su herramienta de edición de archivos. La acción debería denegarse.

Las restricciones de las herramientas de archivos tienen un alcance definido.

Los procesos arbitrarios de Python o Node pueden acceder a archivos mediante su propio código; el aislamiento (sandboxing) del sistema operativo aporta restricciones entre esos procesos cuando se requiere.

Para una escritura externa, identifica el destino y el contenido exacto que se está aprobando. Si el contenido cambia, revisa la acción actualizada antes de ejecutarla.

Un tiempo de espera agotado también necesita un paso claro de recuperación.

Inspecciona el destino antes de reintentar una escritura externa, porque el primer intento podría haberse completado.

5. Haz que el revisor devuelva evidencia

Dale a la verificación una tarea delimitada con un reporte que el agente principal pueda usar.

Un subagente tiene su propio contexto y herramientas configurables para ese trabajo. Configuración de subagentes

beamnxw ./ - inline image

El revisor debería recibir la ruta del borrador, las ubicaciones de fuentes relevantes y las afirmaciones que necesita inspeccionar.

Especifica cómo debe reportar la incertidumbre.

Pega esto en .claude/agents/evidence-reviewer.md:

text
1---
2name: evidence-reviewer
3description: Verificar afirmaciones fácticas en borradores usando fuentes primarias.
4tools: Read, Grep, Glob, WebSearch, WebFetch
5effort: high
6---
7Lee el borrador proporcionado y su material fuente.
8Verifica las afirmaciones fácticas contra las fuentes primarias abiertas.
9Devuelve una tabla: afirmación, veredicto, URL de la fuente, corrección requerida.
10Usa estos veredictos: verified, incorrect, unresolved.
11Para las afirmaciones sin resolver, indica qué evidencia falta.

Este worker recibe herramientas de lectura y búsqueda.

Las correcciones del borrador quedan a cargo del agente principal.

Cada hallazgo debe conectar una afirmación con una fuente abierta.

Un veredicto como "incorrect" necesita la evidencia contradictoria y una corrección que el autor pueda aplicar.

Un veredicto "unresolved" debe identificar la evidencia faltante.

El agente principal revisa los hallazgos, actualiza el borrador y verifica la redacción corregida. Un reporte de revisor seguro aún necesita evidencia útil detrás de sus recomendaciones.

Vuelve a revisar las oraciones adyacentes cuando una corrección cambie el significado de un párrafo.

La guía de evaluación de Anthropic separa la transcripción de un agente del resultado que queda en el entorno.

También describe distintos métodos de verificación para diferentes tipos de resultados. Evaluaciones de agentes

beamnxw ./ - inline image

Aplica esa distinción aquí abriendo el borrador guardado y verificando las afirmaciones citadas.

La tabla de revisión debe describir el documento que realmente se va a aceptar.

6. Asígnale esfuerzo de razonamiento al trabajo

Inicia la sesión principal en `medium`; Opus 5.5 usa ese valor predeterminado a menos que la configuración aplicable lo anule.

El revisor anterior solicita `high` para su trabajo de verificación. Configuración de esfuerzo

beamnxw ./ - inline image
beamnxw ./ - inline image

Con Claude Code instalado y tu cuenta iniciada, ejecuta esto desde la raíz del espacio de trabajo:

bash
1claude --model claude-opus-5-5 --effort medium

Confirma Opus 5.5 y el esfuerzo activo en el encabezado de la sesión.

El comando de inicio establece el modelo y el esfuerzo para esa sesión.

El esfuerzo se puede configurar para un skill o subagente, sujeto a los niveles compatibles del modelo y los límites aplicables.

Escribir una instrucción sobre la profundidad de pensamiento deja intacta la configuración de esfuerzo establecida.

Elige una tarea cuyo resultado puedas inspeccionar antes de cambiar la configuración. Registra qué verificaciones de aceptación pasaron y qué correcciones necesitó el entregable.

Esto convierte el esfuerzo en una decisión ligada a un trabajo específico.

Una revisión de fuentes con afirmaciones ambiguas puede tener su propia configuración mientras el flujo de trabajo principal de redacción mantiene su nivel elegido.

Antes de la primera ejecución, usa `/context` para inspeccionar las instrucciones cargadas, `/agents` para confirmar el revisor y `/permissions` para revisar las reglas de acción.

Corrige los componentes faltantes antes de asignar la tarea completa.

7. Dile a la ejecución qué debe demostrar

Define la finalización en términos de entregables guardados y resultados de verificación.

Un borrador, su tabla de verificación y una nota de progreso actualizada le dan a la ejecución entregables concretos que producir.

El comando `/goal` de Claude Code evalúa una condición de finalización contra la evidencia que surge en la conversación entre turnos. El evaluador depende de que el agente muestre los resultados relevantes. Documentación de goal

beamnxw ./ - inline image

Coloca el tema, el material de referencia y los enlaces de fuentes en `sources/`. Luego pega esto en Claude Code:

text
1/goal Usa write-draft para preparar un artículo a partir de sources/. La finalización requiere que existan drafts/article.md y drafts/checks.md, que las afirmaciones incorrectas estén corregidas, que las afirmaciones sin resolver estén claramente marcadas, y que las rutas de salida más los resultados de verificación aparezcan en la conversación. Detente después de 12 turnos si la condición no se cumple y reporta el bloqueo.

La cláusula de turnos la evalúa el modelo. Los límites estrictos de tiempo de ejecución o gasto necesitan controles de ejecución, y `/goal clear` elimina un objetivo activo.

Cuando termine la ejecución, abre ambos archivos e inspecciona algunas coincidencias entre afirmaciones y fuentes.

Verifica que la nota de progreso coincida con el trabajo guardado en el espacio de trabajo.

Usa el mismo formato de evidencia para la próxima tarea.

Un reporte consistente te permite identificar afirmaciones sin resolver y verificaciones faltantes sin reconstruir toda la conversación.

Para recuperarte, `/rewind` puede restaurar las ediciones de archivos rastreadas. Los cambios de shell y la mayoría de las ediciones de subagentes requieren una recuperación aparte, mientras que el control de versiones conserva un historial duradero de archivos. Límites de puntos de control

beamnxw ./ - inline image

Ejecuta el flujo de trabajo completo una vez

Crea las carpetas de fuentes y los cuatro archivos de configuración antes de iniciar la sesión => Coloca un resumen breve de la tarea junto al material fuente para que el resultado solicitado quede explícito.

Copia esto en sources/task.md y completa los detalles:

text
1Tema: [tema específico]
2Lector: [quién necesita esta explicación]
3Entregable: Un artículo con pasos prácticos y fuentes oficiales.
4Aceptación: Temas requeridos cubiertos; afirmaciones fácticas verificadas;
5afirmaciones sin resolver marcadas; borrador y tabla de revisión guardados.
6Restricciones: [extensión, estilo, temas excluidos]

Inicia Claude Code con el comando de la capa seis e inspecciona la configuración cargada => Ejecuta el objetivo de la capa siete y luego revisa los entregables guardados.

El resultado esperado es `drafts/article.md`, `drafts/checks.md` y `progress.md`.

La tabla de verificación debe identificar qué se comprobó y qué aún necesita tu atención.

Si falta el skill, inspecciona su ruta y frontmatter.

Si falta el revisor, verifica su `name` y `description`, y luego confirma su disponibilidad mediante `/agents`.

Para las afirmaciones sin resolver, inspecciona la fuente proporcionada y la evidencia que solicitó el revisor.

Resuelve la brecha o mantenla visiblemente marcada antes de aceptar el borrador.

Revisa qué puede recuperar la próxima sesión

Actualiza `progress.md` después de cada etapa importante.

Registra los archivos actuales, las verificaciones completadas, las preguntas abiertas y el siguiente paso.

El archivo CLAUDE.md de la raíz se vuelve a leer después de la compactación.

Las instrucciones con alcance se recargan cuando se accede a los archivos relevantes. Compactación y memoria

Usa esta estructura compacta para la nota de progreso:

text
1Tarea: [tema actual]
2Entregables: [rutas del borrador y la revisión]
3Completado: [etapas y verificaciones terminadas]
4Decisiones: [elecciones confirmadas y sus fuentes]
5Temas pendientes: [evidencia faltante o bloqueos]
6Siguiente paso: [un paso concreto para continuar]

Inicia una sesión nueva en el mismo espacio de trabajo y pega:

text
1Lee progress.md e inspecciona el borrador y las verificaciones referenciadas.
2Continúa desde el siguiente paso registrado y actualiza la nota de progreso.

La sesión debería identificar el trabajo guardado y continuar desde el punto de traspaso. Si empieza de cero, inspecciona la nota y agrega la decisión o ruta de archivo faltante.

La guía de agentes de larga duración de Anthropic usa registros de progreso persistentes para respaldar el trabajo entre sesiones.

Mantén esos registros actualizados a medida que cambie la tarea para que una ejecución reanudada tenga información vigente. Harnesses de larga duración

beamnxw ./ - inline image

Mide la configuración con el trabajo aceptado

Usa `/usage` para inspeccionar el uso reportado y `/context` para ver qué ocupa el contexto de trabajo. Incluye la revisión delegada y los reintentos en el total de la tarea. Guía de uso

Registra tu tiempo de revisión y las correcciones que requirió el resultado.

Un entregable que necesita reparaciones importantes cambia el valor de toda la ejecución.

Mantén la tarea y los criterios de aceptación consistentes cuando pruebes un cambio de configuración.

Ajusta un componente, repite la tarea e inspecciona tanto el resultado guardado como su evidencia.

La reducción del 60 % de tokens que sugiere el reporte de probadores tempranos de Anthropic corresponde a ese experimento con el modelo.

Calcula tus propios ahorros con tu harness midiendo las tareas completadas. Anuncio de Opus 5.5

Después de la primera ejecución aceptada, reutiliza el skill con un tema y conjunto de fuentes nuevos. Mantén constante el revisor, las rutas de salida y el formato de finalización, y luego actualiza el procedimiento cuando una corrección recurrente revele un paso faltante.

Guárdalo para no perderlo

Sigue a @beamnxw para más alpha :)

=> mi Substack

=> mi canal de Telegram

Recrear en YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales