Mismo precio. La mayoría cambiará el modelo y se perderá todo lo demás.

Junto con Opus 4.8, Anthropic lanzó tres cosas que cambian la forma de trabajar en Claude Code más que los números de los benchmarks: control de esfuerzo, flujos de trabajo dinámicos y modo rápido más barato. Quienes los configuren bien obtendrán mejores resultados y gastarán menos. Aquí está el desglose.
El número que más importa
No es el 69.2% en coding. Es que 4.8 tiene aproximadamente 4 veces menos probabilidades de dejar pasar fallos en el código que él mismo escribió.
Los modelos antiguos solían decir con seguridad "listo, error corregido" con evidencia escasa. Anthropic apostó por la honestidad: 4.8 se toma más tiempo a menudo y señala dónde no está seguro, en lugar de generar código plausible que rompe silenciosamente los casos límite. En una sesión larga, esto se acumula. Un modelo que admite incertidumbre en el turno 15 te ahorra un par de horas de depuración en el turno 40.
Lo que cambió: la versión corta
Coding.
SWE-bench Verified: 87.6% → 88.6% (cerca del techo).
SWE-bench Pro (más difícil, menos contaminado): 64.3% → 69.2%, más de 10 puntos por delante de GPT-5.5.
Este es el número estrella de coding.
Terminal.
Terminal-Bench 2.1: 66.1% → 74.6% (+8.5), pero GPT-5.5 sigue liderando (78.2%). El único benchmark de siete donde 4.8 pierde.
Trabajo de conocimiento.
GDPval-AA: 1890 Elo vs 1769 de GPT-5.5. La brecha más amplia de toda la tabla.
Uso del ordenador.
OSWorld-Verified: 83.4% (parte de la mejora se debe a un harness actualizado, lo que Anthropic señala abiertamente).
Ciencia.
GPQA Diamond: 93.6%, prácticamente plano (ambos modelos superan el 93%, eso es saturación, no una regresión).

La propia Anthropic califica el lanzamiento como "una mejora modesta pero tangible." Los benchmarks son un plus. Los cambios operativos a continuación son la verdadera historia.
Función 1. Control de esfuerzo (la más infravalorada)
Opus 4.8 viene por defecto con esfuerzo Alto. Pero ahora tú decides cuánto razonamiento invierte en una tarea. Piénsalo como una transmisión manual para el razonamiento.
En claude.ai y Cowork, el deslizador está junto al selector de modelo, con cinco niveles: Bajo, Medio, Alto (Predeterminado), Extra, Máximo, más un interruptor separado de Pensamiento. En Claude Code son los mismos niveles con nombres ligeramente distintos, y hay un modo automático:
Nota: "Extra" en claude.ai y xhigh en Claude Code son el mismo nivel, solo etiquetas diferentes en distintas superficies.

La parte clave, para que no haya confusión. NO hay un recargo adicional por nivel de esfuerzo. La tarifa es la misma en todos los niveles: $5 por 1M de tokens de entrada, $25 por 1M de salida. La diferencia no está en el precio por token, sino en cuántos tokens gasta el modelo. Bajo responde de forma breve y piensa poco, Máximo piensa mucho y consume varias veces más tokens. Por lo tanto, Máximo es "más caro" por el volumen, no por la tarifa.
Una guía aproximada del gasto relativo en la misma tarea (cifras ilustrativas, para intuición):
Un ejemplo económico. Supongamos que una respuesta en Alto cuesta ~$0.05. La misma solicitud en Bajo cuesta ~$0.005, y en Máximo puede alcanzar fácilmente ~$0.20-0.40. Si el 60% de tus indicaciones son pequeñas ("¿qué devuelve esta función?"), pasarlas de Alto a Bajo reduce el gasto diario varias veces, sin pérdida de calidad donde importa.
Por qué esto impacta más en la factura. La mayoría dejará todo en Alto (o lo subirá a Máximo "para estar seguro") y nunca tocará el deslizador. Quienes asignan el esfuerzo por tarea obtienen los mismos resultados por notablemente menos. Esa es la función más infravalorada del lanzamiento.
Función 2. Modo rápido (3 veces más barato)
El modo rápido ejecuta Opus a 2.5x de velocidad con la misma calidad, y ahora es 3 veces más barato que antes.
Actívalo en Claude Code con /fast (una sesión activa se marca con un icono ↯). El acceso por API está restringido por ahora (lista de espera en claude.com/fast-mode).
Usa el modo rápido para: refactorizaciones grandes de múltiples archivos, generación de código a partir de especificaciones, documentación, generación de pruebas. En cualquier lugar donde la velocidad supere a la profundidad. Quédate en el modo estándar para: depuración compleja, decisiones de arquitectura, revisión de seguridad. En cualquier lugar donde la calidad del pensamiento supere a la velocidad.
Función 3. Flujos de trabajo dinámicos (la grande)
Claude Code ahora escribe un script de orquestación en JavaScript para tu tarea y lo ejecuta en segundo plano mientras tu sesión sigue siendo receptiva. El plan reside en el código, no en el contexto del modelo, por lo que solo la respuesta final regresa a tu sesión.
Lo que debes saber, según la documentación oficial:
- Hasta 16 subagentes simultáneos, con un límite máximo de 1.000 por ejecución.
- Reanudable: si tu portátil se apaga o cierras la terminal, la ejecución se retoma donde se quedó.
- Requiere Claude Code v2.1.154+. Vista previa de investigación.
- Activado por defecto en los planes Max, Team y Enterprise. En el plan Pro, actívalo en /config (y cambia primero a Opus 4.8).
- Los subagentes se ejecutan en modo acceptEdits y heredan tu lista de herramientas permitidas.
Actívalo con /effort ultracode (una configuración de Claude Code: xhigh más orquestación automática de flujos de trabajo), o simplemente describe una tarea grande con palabras:

Ideal para: migraciones de más de 200 archivos, auditorías de seguridad de todo el código base, generación de pruebas en todo el proyecto, refactorizaciones grandes, investigación en múltiples repositorios. No es adecuado para: correcciones de errores simples, ediciones de un solo archivo, preguntas rápidas. Es excesivo.
Sobre los costes. Los flujos de trabajo consumen significativamente más tokens que una sesión normal. La forma oficial de mantener el gasto bajo control es delimitar la tarea: ejecuta primero una auditoría en una carpeta, observa cuántos subagentes genera y luego calibra la ejecución grande a partir de ahí.
Para deshabilitar los flujos de trabajo por completo:
Ejemplo de configuración de Claude Code (plantilla inicial)
Variables de entorno (en ~/.zshrc o ~/.bashrc):
Luego viene la parte útil: un settings.json con permisos seguros. Permite al modelo leer y editar código, ejecutar pruebas y hacer commit, pero bloquea estrictamente lo peligroso: leer .env y claves SSH, rm -rf, sudo y git push. El agente trabaja libremente pero no puede romper nada ni filtrar nada.

El archivo settings.json listo para copiar está en mi canal de Telegram (el formato es demasiado grande para leerlo bien aquí): t.me/+JmDeelv5UCwwMTcy

Hoja de trucos de comandos diarios
Instalar Opus 4.8: tres formas
A. Navegador o aplicación. En claude.ai, selecciona Claude Opus 4.8 en la lista de modelos y ajusta el deslizador de esfuerzo. No necesita instalación.
B. API. ID del modelo claude-opus-4-8. Precio $5/$25 por 1M. Contexto de hasta 1M (200k en Microsoft Foundry), hasta 128k de salida. El pensamiento extendido con presupuesto fijo no es compatible: usa pensamiento adaptativo (thinking: {type: "adaptive"}) y el parámetro de esfuerzo.
C. Claude Code (terminal). El instalador nativo es ahora el método recomendado (npm es legado):
Luego ejecuta claude, inicia sesión a través del navegador y selecciona Opus 4.8 con /model.
Lista de verificación de migración: 4.7 a 4.8
- Cambia el ID del modelo a claude-opus-4-8
- Ejecuta de 10 a 20 de tus tareas reales en 4.7 y 4.8 con indicaciones idénticas
- Compara: tasa de finalización, número de pasos, tokens, tasa de aprobación de pruebas
- Revisa las indicaciones ajustadas al comportamiento de 4.7
- Asigna niveles de esfuerzo por tipo de tarea
- Prueba el modo rápido donde la velocidad importe
- Actualiza Claude Code a v2.1.154+ (para flujos de trabajo)
- Vuelve a revisar la factura de la API después de la primera semana
Tarjeta de referencia: todo en un solo lugar
Modelo: claude-opus-4-8 · lanzado el 2026-05-28
Precio: $5 / $25 por 1M · modo rápido $10 / $50
Contexto: hasta 1M · hasta 128k de salida
Clave: SWE-bench Pro 64.3% → 69.2% (+10 sobre GPT-5.5) · SWE-bench Verified 88.6% · 4 veces menos errores pasados por alto · GDPval-AA 1890 Elo
Nuevo: control de esfuerzo · modo rápido 3 veces más barato · flujos de trabajo dinámicos (16 simultáneos / 1.000 por ejecución)
Gracias por leer. Si te llevas algo de esto, que sea "asigna el esfuerzo por tarea."
El resto de mis notas sobre Claude y vibe coding están aquí: t.me/+JmDeelv5UCwwMTcy.
Nos vemos allí.
@shmidtqq.





