Todos los agentes que has usado hasta ahora venían en un solo paquete. El armazón —la computadora, los inicios de sesión, la memoria, las rutinas— y el cerebro que lo impulsa fueron creados por la misma empresa y se vendían juntos.
El 7 de octubre, Grok Bot los separó:
https://x.com/elonmusk/status/2107724314451878104
A partir de ahora, SpaceX enruta cada tarea al mejor modelo de back-end, y el primero de la lista es Claude Opus 5.5. SpaceX se quedó con el armazón. El cerebro ahora es de Anthropic.
Esa combinación es la versión más potente del producto hasta la fecha: un agente que tiene su propia computadora y trabaja mientras duermes, impulsado por el modelo que lidera los benchmarks independientes en tareas agénticas de múltiples pasos.
Este es el tutorial de 10 pasos
desde entender qué cambió hasta poner en marcha un equipo de especialistas impulsados por Opus que se pasan el trabajo entre sí, y te involucran solo cuando hace falta una decisión humana.
01. Entiende qué acaba de cambiar
Todo empezó con una publicación. A última hora del 6 de octubre (hora de EE. UU.), Musk escribió en X que SpaceX usaría el mejor modelo de back-end para cada tarea, mencionando a Claude Opus 5.5, Midjourney y Suno. Su frase de cierre: "Lo que tenga más probabilidades de darte el mejor resultado".
Horas después, Lauren (@poteto), del equipo de Grok Bot, lo hizo concreto: todos los bots funcionarán con Opus 5.5 y podrán generar agentes en la nube que usen los modelos de Cursor. 9to5Mac lo confirmó en directo el 7 de octubre.
https://x.com/claudeai/status/2107894039626277339
¿Por qué usar el modelo de un rival? Porque en el trabajo real que hace un agente, la diferencia es enorme. Artificial Analysis midió ambos laboratorios sobre el mismo armazón:

Un matiz: se trata de Grok 4.6, no del Grok 4.7 de septiembre, y ambas mediciones se hicieron con un mes de diferencia. Pero Terminal-Bench es la métrica que predice si puedes encargarle un trabajo completo a un modelo en lugar de hacerle una pregunta, y ahí la brecha es casi de 3x.
https://x.com/zhuokaiz/status/2102825912471527738
X reaccionó antes que la prensa:
El 7 de octubre, Grok Bot los separók al mejor modelo de back-end, y el primero de la lista es Claude Opus 5.5. SpaceX se quedó con el armazón. El cerebro ahora es de Anthropic.
Quién
Qué dijeron
Theo - t3.gg (@theo)
"Mala noticia, chicos: Grok Bot es realmente bueno" — 4,4 millones de visualizaciones, publicado horas antes de la noticia. Lauren respondió al día siguiente que acababa de mejorar aún más.
Lauren (@poteto)
Citó la publicación de Musk para anunciar que Grok Bot recibiría una actualización.
Iorel (@Iorel_X)
Lo planteó como la apertura de Grok Bot a modelos externos, en lugar de quedarse atado a uno solo.
02. Instálalo y conoce al Jefe
Grok Bot es una aplicación, no una pestaña del navegador. Funciona en Mac, iPhone y iPad. Inicias sesión con tu cuenta de Grok o de Cursor; no se vende por separado, viene incluido en la mayoría de los planes SuperGrok y en los planes de pago de Cursor.
Llegas a algo más parecido a un cliente de mensajería que a un chatbot: bots con nombre a la izquierda, una conversación a la derecha. Cada bot tiene su propia computadora en la nube.

No tienes que configurar nada para usar Opus 5.5. Según el equipo de Grok Bot, es el modelo predeterminado para todos los bots. No hay una suscripción aparte de Claude.
Empieza con un bot de uso general: llámalo el Jefe. Su función es ser aquel al que le escribes cuando todavía no sabes qué especialista debería encargarse de una tarea.
Dale un encargo real con un resultado que puedas verificar en treinta segundos. Todos los pasos siguientes consisten en confiarle trabajos más grandes, así que empieza por uno que puedas comprobar.
03. Redacta un estatuto para un cerebro más potente
Un prompt es una petición. Un bot es un rol: persiste, construye memoria y es dueño de un área. Por eso, ponle el nombre de un puesto: Gestor de Bandeja de Entrada, Líder de Investigación, Ventas Outbound.

Luego, dale instrucciones como a un empleado nuevo: de qué es responsable, cómo se ve un buen trabajo y dónde debe detenerse para consultarte.
Esto es lo que cambia con Opus 5.5. Los estatutos escritos para el modelo anterior eran defensivos —cadenas cortas, revisiones frecuentes— porque el modelo se estancaba a los pocos pasos. Con un cerebro que puntúa casi 3 veces más alto en tareas de múltiples pasos, puedes delegarle el trabajo completo, no solo el primer paso.
Opus 5.5 también admite una ventana de contexto de 1 millón de tokens y hasta 128K tokens de salida en la API. Cuánto de eso expone Grok Bot no está publicado, pero ahora la clave son los trabajos más largos.
1El prompt del estatuto — diseñado para Opus 5.52Eres mi Líder de Investigación.34// de qué eres responsable5Dado un tema, ejecuta todo el trabajo de principio a fin: encuentra fuentes primarias,6abre cada página que cites, cruza los datos con al menos dos fuentes7y redacta un informe de 1.500 palabras.89// cómo se ve un buen trabajo10Cada cifra lleva un enlace al lado. Las fuentes contradictorias se11marcan, no se promedian. El borrador va a mi carpeta de Drive, no al chat.1213// dónde debes detenerte14Nunca publiques. Nunca envíes correos a nadie. Solo borradores.15Si dos fuentes discrepan y no puedes resolverlo, déjalo en pausa y pregúntame.
La regla: un cerebro más inteligente recibe más pasos, no más autoridad. El bloque de "dónde debes detenerte" sigue siendo tan estricto como antes.
04. Conecta las herramientas una vez y traza la línea de datos

Grok Bot incluye un panel de plugins con conexiones de un clic: Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio y Context7, además de opciones personalizadas.
Las conexiones son a nivel de cuenta. Conecta Gmail una vez y todos los bots que crees podrán usarlo. Tu quinto bot será productivo en segundos.
La novedad: tus datos ahora tienen un segundo destino. Cuando un bot razona con Opus 5.5, lo que lee viaja a Anthropic para ese paso. La pregunta de Tom sobre cómo excluirse bajo la publicación de Musk aún no tiene respuesta, y SpaceXAI no ha publicado los términos sobre qué se comparte.
No puedes elegir dónde se ejecuta el modelo. Sí puedes elegir qué toca el bot. Añade esto a cada estatuto:
1// la línea de datos — añádela a cada estatuto2No abras, leas ni resumas:3 - nada de mis carpetas /Legal o /Finance en Drive4 - correos de mi abogado, contable o banco5 - ningún mensaje con contraseñas, frases semilla o códigos 2FA67Si una tarea requiere algo de esto, detente y pregúntame primero.8Cuando trabajes con un documento, usa solo lo que la tarea necesite.
Conecta solo lo que realmente necesitas y deja el resto intacto. Durante una beta, cada conexión llega a todos los bots y, ahora, a más de una empresa.
05. Cede la sesión, nunca la contraseña
La mayor parte del software dentro de una empresa real no tiene API ni servidor MCP. Este es el mecanismo que permite que Grok Bot funcione con él de todos modos.
El bot navega por su propio navegador en la nube hasta toparse con una pantalla de inicio de sesión. Entonces te cede la pantalla. Tú inicias sesión, haces clic en listo y el bot retoma el trabajo en la misma sesión donde lo dejó.
El bot obtiene una sesión, no un secreto. Nunca escribes una credencial en el chat y, con un modelo de terceros ahora en la ecuación, eso importa más que nunca. Una contraseña pegada en una conversación es texto que el modelo lee. Un inicio de sesión hecho en la pantalla cedida, no.
La regla que debes exigir: si alguna herramienta te pide pegar una contraseña en un mensaje, ese es el camino equivocado.
06. Muéstraselo una vez y conviértelo en rutina
Puedes enseñarle un flujo de trabajo a un bot haciéndolo una vez mientras observa. Guarda los pasos y los ejecuta por su cuenta la próxima vez.

La mejor primera grabación es recurrente, multi-herramienta y estable: algo que haces semanalmente, en dos o más aplicaciones, donde los pasos casi nunca cambian. Tedioso de explicar, cuarenta segundos de mostrar.
Después, dale a la rutina un motivo para activarse. Dos opciones, ambas configuradas en lenguaje natural: sin lienzos de nodos ni constructores de flujos de trabajo.
1// programación — el resumen matutino2Cada día laborable a las 7:00 a. m., revisa mi calendario, mi bandeja de entrada y el3canal #lanzamientos de Slack. Un resumen breve: qué toca hoy,4qué necesita respuesta y qué cambió durante la noche.56// disparador — el receptor de entradas7Cada vez que llegue un correo de un dominio que no esté en mis contactos y8mencione precios, redacta una respuesta desde la plantilla y déjala en pausa.910// el atajo que crea la mayoría de las rutinas11Ejecuta esto cada semana.12 ^ dicho justo después de una tarea que te gustó.
Aquí es donde Opus 5.5 justifica su precio: las rutinas se rompen cuando un sitio cambia su diseño o un dato de entrada se ve ligeramente distinto. Un modelo más fuerte en tareas de múltiples pasos tiene más probabilidades de recuperarse ante una página modificada en lugar de fallar en silencio.
07. Contrata especialistas que generen agentes de Cursor
Ejecuta varios bots en paralelo, cada uno dueño de un área. Bots separados significan memorias separadas, contextos separados y un hilo limpio para revisar cuando algo sale mal. SpaceXAI dice que sus propios equipos usan bots para prospección de ventas, marketing, operaciones de oficina y corrección de errores.
Divide por área, no por tamaño de tarea. Un Gestor de Gastos que solo piensa en recibos se vuelve experto en tus recibos.
La nueva capa es la mitad más discreta del anuncio del equipo de Grok Bot: los bots pueden generar agentes en la nube que ejecuten cualquiera de los modelos de Cursor. Eso encaja con el mapa de propiedad: SpaceX compró Cursor en agosto por 60.000 millones de dólares.
Así, un bot de programación se convierte en gestor. El bot impulsado por Opus planifica el trabajo y mantiene el contexto. Los agentes de Cursor hacen el trabajo pesado en paralelo. El bot revisa lo que regresa.
1// el Mantenedor de Repositorio — un bot que gestiona agentes2Eres mi Mantenedor de Repositorio.34Cuando un issue se etiquete como "bug" en GitHub:51. Reprodúcelo en tu computadora y escribe un test que falle.62. Genera un agente de Cursor en la nube para arreglarlo en una nueva rama.73. Ejecuta toda la suite de tests sobre el resultado.84. Abre un PR en borrador con el test, la corrección y un resumen de 3 líneas.910Nunca hagas merge. Nunca subas código a main.11Si la corrección afecta autenticación, facturación o una migración, déjamelo en pausa.
Los usuarios en X ya estaban haciendo una versión de esto antes del anuncio: a finales de septiembre se publicó cómo generar agentes de Cursor en la nube desde Grok Bot.
https://x.com/mikepat711/status/2103551603102126149
08. Ponlos en un chat grupal
Los bots pueden enviarse mensajes entre sí y compartir contexto en hilos. Pon varios en un chat grupal y se coordinarán solos: pasándose el trabajo, asignando responsables e involucrándote solo en decisiones que requieran criterio humano.
El ejemplo de la propia SpaceXAI: un bot de ingeniería reproduce un error, abre un ticket y se lo pasa a un segundo bot para depurarlo. Que un bot decida que otro es más adecuado para la tarea —y le ceda la responsabilidad— es algo que ninguna herramienta de chat individual hace.
Desde finales de septiembre, los equipos también pueden publicar un bot compartido que sus colegas usen en la app o en Slack.
El truco es darle al grupo un objetivo, no una lista de tareas. Una lista de tareas significa que ya hiciste tú la descomposición. Un objetivo les permite repartirse el trabajo, y la descomposición es exactamente el tipo de razonamiento de múltiples pasos en el que Opus 5.5 destaca.
1// objetivo, no tareas2Meta: lanzar el boletín de octubre antes del viernes a las 17:00.34El Líder de Investigación se encarga de los datos y las fuentes.5El Gestor de Bandeja de Entrada se encarga de las respuestas de los suscriptores.6El Jefe controla los plazos y me avisa de lo que esté bloqueado.78Repartíos el trabajo vosotros mismos. Dejadme en pausa todo lo que sea público.
09. Traza la línea de aprobación
La premisa de Grok Bot es que un bot termina los trabajos de principio a fin y solo vuelve cuando algo necesita tu aprobación. Eso te obliga a ti a definir "necesita aprobación", porque el criterio por defecto del bot puede no coincidir con el tuyo.

La línea que funciona no depende del tamaño de la tarea, sino de la reversibilidad. Todo lo que el bot pueda deshacer, lo termina solo. Todo lo que vea el mundo exterior, mueva dinero o no pueda revertirse, queda en pausa para ti.
Esto importa más ahora, no menos. Un cerebro más potente avanzará más en una tarea antes de topar con tu límite, así que ese límite tiene que ser explícito.
1// termina esto solo, siempre2borrador · archivar · etiquetar · resumir · investigar · preparar · conciliar3 todo lo reversible. no preguntes, hazlo y regístralo.45// déjame esto en pausa, siempre6enviar cualquier cosa a alguien fuera de la empresa7gastar o mover dinero, o comprometerte con un precio8publicar cualquier cosa pública9borrar algo que no sea basura evidente10aceptar términos o registrarte en algo1112// ante la duda13Si no puedes deshacerlo en menos de un minuto, déjalo en pausa y pregúntame.
La forma ideal para cada bot: 36 borradores en cola, 0 enviados. Todos los pasos reversibles completados y un freno en seco en el primer paso irreversible.
10. Vigila el coste, revisa cada semana
Opus 5.5 no es un cerebro barato. En la API su precio está muy por encima de Grok:

En un trabajo pequeño —30K tokens de entrada, 8K de salida— son unos 28 centavos frente a 11. En contextos muy largos, el orden se invierte, porque las tarifas de Grok se duplican por encima de los 200K tokens y las de Opus se mantienen fijas.
En Grok Bot no pagas por token: está incluido en tu plan. La pregunta abierta, la que Adam Hincu planteó en X, es si los trabajos impulsados por Opus consumen los límites del plan más rápido. SpaceXAI no se ha pronunciado. Así que vigila el uso durante la primera semana antes de añadir rutinas.

Y no todo lo anunciado está activo. Midjourney y Suno no tienen fecha, y al menos el bot de un usuario dijo que Suno no estaba disponible el primer día. Construye sobre Opus 5.5 —eso está confirmado—. Espera por el resto.
Después, reserva quince minutos a la semana en el calendario y deja que los bots informen sobre sí mismos:
1Enumera todas las rutinas que ejecutaste esta semana. Para cada una:23 - cuántas veces se activó4 - qué produjo5 - algo que omitió, falló o tuvo que adivinar6 - algo que dejaste en pausa para mí y que nunca respondí78Luego dime cuál es la menos útil y por qué.9Si no puedes identificar qué modelo manejó un paso, dilo.
Revisa manualmente un resultado por rutina. Un bot que evalúa su propio trabajo tiene el mismo punto ciego que tú.
Conclusión: el armazón es el producto
Durante tres años, la pregunta fue qué modelo era el mejor. Esta semana, el constructor de modelos más agresivo del mercado respondió a otra distinta: qué armazón es el mejor, y luego metió dentro el cerebro de un rival.
Ese es el cambio. El armazón posee la computadora, los inicios de sesión, la memoria y las rutinas. El cerebro se puede intercambiar por debajo, y ahora mismo el mejor para tareas agénticas es Opus 5.5.
Tu trabajo no cambia. Tú decides qué delegar, dónde termina la autoridad del bot y qué datos puede tocar. Escribe esas tres cosas en el estatuto y deja que el cerebro más potente del mercado se encargue de hacer clic.





