Jusqu'à présent, chaque agent que vous avez utilisé était livré en un seul bloc. Le châssis — l'ordinateur, les identifiants, la mémoire, les routines — et le cerveau qui le pilote étaient conçus par la même entreprise et vendus ensemble.
Le 7 octobre, Grok Bot a séparé les deux :
https://x.com/elonmusk/status/2107724314451878104
Désormais, SpaceX route chaque tâche vers le meilleur modèle back-end — et le premier nom sur la liste est Claude Opus 5.5. SpaceX a gardé le châssis. Le cerveau appartient maintenant à Anthropic.
Cette combinaison donne la version la plus aboutie du produit à ce jour : un agent qui possède son propre ordinateur et travaille pendant que vous dormez, piloté par le modèle qui domine les benchmarks indépendants sur les tâches agentiques multi-étapes.
Voici le tutoriel en 10 étapes
De la compréhension de ce qui vient de changer jusqu'au pilotage d'une équipe de spécialistes propulsés par Opus qui se refilent le travail entre eux — et ne vous sollicitent que pour les décisions qui exigent un humain.
01. Comprendre ce qui vient de basculer
Tout est parti d'un simple post. Tard dans la soirée du 6 octobre (heure américaine), Musk a écrit sur X que SpaceX utiliserait le meilleur modèle back-end pour chaque tâche donnée, en citant Claude Opus 5.5, Midjourney et Suno. Sa phrase de conclusion : « Tout ce qui a le plus de chances de vous donner le meilleur résultat. »
Quelques heures plus tard, Lauren (@poteto), de l'équipe Grok Bot, a rendu les choses concrètes : tous les bots seront propulsés par Opus 5.5, et ils pourront générer des agents cloud tournant sur les modèles de Cursor. 9to5Mac a confirmé l'information en direct dès le 7 octobre.
https://x.com/claudeai/status/2107894039626277339
Pourquoi choisir le modèle d'un concurrent ? Parce que sur le travail réel qu'effectue un agent, l'écart est immense. Artificial Analysis a testé les deux labos sur le même châssis :

Une nuance toutefois : il s'agit de Grok 4.6, et non de Grok 4.7 sorti en septembre, les deux mesures ayant été prises à un mois d'intervalle. Mais Terminal-Bench est précisément l'indicateur qui prédit si vous pouvez confier un boulot complet à un modèle plutôt qu'une simple question — et là, l'écart frôle le x3.
https://x.com/zhuokaiz/status/2102825912471527738
X a réagi avant même la presse :
Le 7 octobre, Grok Bot a séparé les deuxvers le meilleur modèle back-end — et le premier nom sur la liste est Claude Opus 5.5. SpaceX a gardé le châssis. Le cerveau appartient maintenant à Anthropic.
Qui
Ce qu'ils ont dit
Theo - t3.gg (@theo)
« Mauvaise nouvelle les gars : Grok Bot est vraiment bon » — 4,4 M de vues, publié quelques heures avant l'annonce. Lauren a répondu le lendemain que ça venait de devenir encore mieux.
Lauren (@poteto)
A cité le post de Musk pour annoncer la mise à niveau de Grok Bot.
Iorel (@Iorel_X)
L'a présenté comme l'ouverture de Grok Bot aux modèles externes, au lieu de rester verrouillé sur un seul.
02. L'installer et faire connaissance avec le Chef
Grok Bot est une application, pas un onglet de navigateur. Il tourne sur Mac, iPhone et iPad. Vous vous connectez avec votre compte Grok ou Cursor — il n'est pas vendu seul, mais inclus dans la plupart des abonnements SuperGrok et des forfaits payants Cursor.
Vous atterrissez dans une interface qui ressemble davantage à un client de messagerie qu'à un chatbot : des bots nommés à gauche, une conversation à droite. Chaque bot dispose de son propre ordinateur dans le cloud.

Pas besoin de modifier le moindre réglage pour obtenir Opus 5.5. Selon l'équipe Grok Bot, c'est désormais le modèle par défaut pour tous les bots. Il n'y a pas d'abonnement Claude séparé.
Commencez par un bot généraliste — appelez-le le Chef. Son rôle : être celui que vous contactez quand vous ne savez pas encore quel spécialiste doit prendre en charge une tâche.
Confiez-lui une vraie mission dont vous pourrez vérifier le résultat en trente secondes. Toutes les étapes suivantes consisteront à lui déléguer des chantiers plus importants — alors commencez par quelque chose de vérifiable.
03. Rédiger une charte pour un cerveau plus puissant
Un prompt est une requête. Un bot est un rôle : il persiste, construit sa mémoire et possède un domaine. Nommez-le donc d'après sa fonction : Gestionnaire de boîte mail, Responsable Recherche, Prospection Vente.

Ensuite, briefez-le comme une nouvelle recrue : ce dont il est responsable, ce qu'on attend de lui, et à quel moment il doit s'arrêter pour vous consulter.
Voici ce qui change avec Opus 5.5. Les chartes rédigées pour l'ancien modèle par défaut étaient défensives — chaînes courtes, points d'étape fréquents — parce que le modèle décrochait après quelques étapes. Avec un cerveau qui score presque 3 fois mieux sur les tâches multi-étapes, vous pouvez lui confier l'intégralité du chantier, et pas seulement la première étape.
Opus 5.5 prend également en charge une fenêtre de contexte de 1 million de tokens et jusqu'à 128K tokens en sortie via l'API. La part exacte exposée par Grok Bot n'est pas publique — mais l'enjeu, désormais, ce sont les missions longues.
1La charte — pensée pour Opus 5.52Tu es mon Responsable Recherche.34// ton périmètre5À partir d'un sujet, mène toute la mission de bout en bout : trouve les sources primaires,6ouvre chaque page que tu cites, recoupe les chiffres sur au moins deux sources,7et rédige une synthèse de 1 500 mots.89// ce qu'on attend de toi10Chaque chiffre doit être accompagné de son lien. Les sources contradictoires doivent être11signalées, pas moyennées. Le brouillon atterrit dans mon dossier Drive, pas dans le chat.1213// tes limites14Ne publie jamais. N'envoie jamais d'e-mail. Brouillons uniquement.15Si deux sources se contredisent et que tu ne peux pas trancher, mets le point de côté et demande-moi.
La règle : un cerveau plus intelligent obtient plus d'étapes, pas plus de pouvoir. Le bloc « tes limites » reste exactement aussi strict qu'avant.
04. Connecter les outils une seule fois — et tracer la ligne rouge des données

Grok Bot intègre un panneau de plugins avec des connexions en un clic : Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio et Context7, ainsi que des intégrations personnalisées.
Les connexions se font au niveau du compte. Connectez Gmail une fois, et tous les bots que vous créerez pourront l'utiliser. Votre cinquième bot est opérationnel en quelques secondes.
La nouveauté : vos données ont désormais une seconde destination. Quand un bot réfléchit avec Opus 5.5, ce qu'il lit transite par Anthropic pour cette étape. La question de Tom sur le droit de retrait sous le post de Musk n'a toujours pas de réponse, et SpaceXAI n'a publié aucune condition sur ce qui est partagé.
Vous ne pouvez pas choisir où le modèle s'exécute. Mais vous pouvez choisir ce que le bot touche. Ajoutez ceci à chaque charte :
1// la ligne rouge des données — à ajouter à chaque charte2N'ouvre pas, ne lis pas et ne résume pas :3 - tout ce qui se trouve dans mes dossiers Drive /Legal ou /Finance4 - les e-mails de mon avocat, de mon comptable ou de ma banque5 - tout message contenant des mots de passe, des phrases de récupération ou des codes 2FA67Si une tâche nécessite l'un de ces éléments, arrête-toi et demande-moi d'abord.8Quand tu travailles sur un document, n'utilise que ce qui est strictement nécessaire à la tâche.
Connectez uniquement ce dont vous avez réellement besoin, laissez le reste tranquille. Pendant une bêta, chaque connexion est accessible à tous les bots — et désormais à plus d'une entreprise.
05. Déléguer la session, jamais le mot de passe
La plupart des logiciels utilisés dans une vraie entreprise n'ont ni API ni serveur MCP. C'est justement le mécanisme qui permet à Grok Bot de fonctionner dessus malgré tout.
Le bot navigue dans son propre navigateur cloud jusqu'à tomber sur un mur de connexion. Il vous passe alors la main. Vous vous connectez, cliquez sur terminé, et le bot reprend exactement là où il s'était arrêté, dans la même session.
Le bot récupère une session, pas un secret. Vous ne tapez jamais d'identifiant dans le chat — et avec l'arrivée d'un modèle tiers dans la boucle, c'est plus crucial que jamais. Un mot de passe collé dans une conversation devient du texte lu par le modèle. Une connexion effectuée sur l'écran qui vous est transmis, non.
La règle absolue : si un outil vous demande un jour de coller un mot de passe dans un message, c'est la mauvaise méthode.
06. Montrer une fois, puis automatiser
Vous pouvez apprendre un workflow à un bot en l'exécutant une fois sous ses yeux. Il enregistre les étapes et les rejoue seul la fois suivante.

Le meilleur premier enregistrement est récurrent, multi-outils et stable : quelque chose que vous faites chaque semaine, sur deux applications ou plus, dont les étapes changent rarement. Fastidieux à expliquer, quarante secondes à montrer.
Donnez ensuite à la routine une raison de se déclencher. Deux options, toutes deux configurées en langage naturel — pas de canevas de nœuds, pas d'éditeur de workflow :
1// planification — le briefing matinal2Tous les jours ouvrés à 7h, consulte mon agenda, ma boîte mail et le canal Slack #launches.3Fais-moi un bref résumé : ce qui est prévu aujourd'hui, ce qui attend une réponse,4ce qui a changé pendant la nuit.56// déclencheur — le capteur d'entrants7Dès qu'un e-mail arrive d'un domaine absent de mes contacts et qu'il mentionne des tarifs,8rédige une réponse à partir du modèle et mets-la de côté.910// le raccourci qui crée la plupart des routines11Exécute ça chaque semaine.12 ^ à dire juste après une tâche qui vous a plu.
C'est là qu'Opus 5.5 justifie sa place : les routines plantent quand un site modifie sa mise en page ou qu'un champ change légèrement d'aspect. Un modèle plus performant sur les tâches multi-étapes a beaucoup plus de chances de s'adapter à une page modifiée au lieu d'échouer silencieusement.
07. Recruter des spécialistes qui génèrent des agents Cursor
Faites tourner plusieurs bots en parallèle, chacun propriétaire d'un domaine. Des bots distincts signifient des mémoires séparées, des contextes isolés et un fil de discussion propre à consulter quand quelque chose déraille. SpaceXAI affirme que ses propres équipes utilisent des bots pour la prospection commerciale, le marketing, les opérations internes et la correction de bugs.
Séparez par domaine, pas par taille de tâche. Un Gestionnaire de notes de frais qui ne pense qu'aux reçus deviendra excellent sur vos reçus.
La nouvelle couche est la moitié la plus discrète de l'annonce de l'équipe Grok Bot : les bots peuvent générer des agents cloud utilisant n'importe quel modèle de Cursor. Cela colle parfaitement à la stratégie de propriété — SpaceX a racheté Cursor en août pour 60 milliards de dollars.
Un bot de code devient donc un manager. Le bot propulsé par Opus planifie le travail et conserve le contexte. Les agents Cursor abattent le gros du travail en parallèle. Le bot vérifie ce qui revient.
1// Le Mainteneur de Repo — un bot qui manage des agents2Tu es mon Mainteneur de Repo.34Quand une issue est étiquetée "bug" sur GitHub :51. Reproduis-la sur ton ordinateur et écris un test qui échoue.62. Génère un agent cloud Cursor pour la corriger sur une nouvelle branche.73. Lance la suite de tests complète sur le résultat.84. Ouvre une PR en brouillon avec le test, le correctif et un résumé de 3 lignes.910Ne merge jamais. Ne pousse jamais sur main.11Si le correctif touche à l'authentification, à la facturation ou à une migration, mets-le de côté pour moi.
Des utilisateurs sur X faisaient déjà une version de cela avant l'annonce — on parlait fin septembre de lancer des agents cloud Cursor depuis Grok Bot
https://x.com/mikepat711/status/2103551603102126149
08. Les réunir dans une conversation de groupe
Les bots peuvent s'envoyer des messages et partager du contexte dans des fils de discussion. Placez-en plusieurs dans un même groupe et ils se coordonnent seuls — se transmettant le travail, s'attribuant les responsabilités, et ne vous sollicitant que pour les arbitrages.
L'exemple donné par SpaceXAI : un bot d'ingénierie reproduit un bug, crée un ticket et le transmet à un second bot pour le débogage. Un bot qui décide qu'un autre est plus compétent — et lui transfère la responsabilité — c'est précisément ce qu'aucun outil de chat individuel ne fait.
Depuis fin septembre, les équipes peuvent également publier un bot partagé que les collègues utilisent dans l'application ou sur Slack.
L'astuce consiste à donner au groupe un objectif, et non une liste de tâches. Une liste de tâches signifie que vous avez déjà fait le découpage. Un objectif leur laisse répartir le travail — et le découpage est exactement le type de raisonnement multi-étapes où Opus 5.5 excelle.
1// un objectif, pas des tâches2Objectif : publier la newsletter d'octobre d'ici vendredi 17h.34Le Responsable Recherche gère les faits et les sources.5Le Gestionnaire de boîte mail gère les réponses des abonnés.6Le Chef gère le planning et me signale ce qui est bloqué.78Répartissez-vous le travail. Mettez de côté tout ce qui est public pour validation.
09. Tracer la ligne de validation
Le principe de Grok Bot est qu'un bot termine les tâches de bout en bout et ne revient vers vous que lorsqu'une approbation est nécessaire. C'est donc à vous de définir ce qui « nécessite une approbation » — car la logique par défaut du bot ne correspondra pas forcément à la vôtre.

La bonne limite ne dépend pas de la taille de la tâche. Elle dépend de la réversibilité. Tout ce que le bot peut annuler, il le termine seul. Tout ce que le monde extérieur voit, ce qui déplace de l'argent ou ce qui ne peut pas être repris vous est soumis.
C'est encore plus vrai aujourd'hui. Un cerveau plus puissant ira plus loin dans une tâche avant de buter sur votre limite — cette limite doit donc être explicite.
1// fais toujours ça seul2brouillon · classement · tag · résumé · recherche · préparation · rapprochement3 tout ce qui est réversible. ne demande pas, fais-le et journalise-le.45// soumets-moi toujours ça6envoyer quoi que ce soit à une personne hors de l'entreprise7dépenser ou déplacer de l'argent, ou s'engager sur un prix8publier quoi que ce soit publiquement9supprimer quoi que ce soit qui n'est pas manifestement du spam10accepter des conditions ou s'inscrire à quoi que ce soit1112// en cas de doute13Si tu ne peux pas l'annuler en moins d'une minute, mets-le de côté et demande-moi.
L'idéal à viser pour chaque bot : 36 brouillons en attente, 0 envoyé. Toutes les étapes réversibles exécutées, un arrêt net à la première irréversible.
10. Surveiller les coûts, faire le point chaque semaine
Opus 5.5 n'est pas un cerveau bon marché. Via l'API, il est nettement plus cher que Grok :

Sur une petite tâche — 30K tokens en entrée, 8K en sortie — cela représente environ 28 centimes contre 11. Sur des contextes très longs, l'ordre s'inverse, car les tarifs de Grok doublent au-delà de 200K tokens tandis que ceux d'Opus restent stables.
Dans Grok Bot, vous ne payez pas au token — tout est inclus dans votre abonnement. La vraie question, celle posée par Adam Hincu sur X, est de savoir si les tâches propulsées par Opus épuisent plus vite les limites du forfait. SpaceXAI ne s'est pas prononcé. Surveillez donc votre consommation la première semaine avant d'ajouter des routines.

Et tout ce qui a été annoncé n'est pas encore disponible. Aucune date pour Midjourney et Suno, et le bot d'au moins un utilisateur a indiqué que Suno n'était pas accessible le premier jour. Construisez sur Opus 5.5 — c'est confirmé. Patientez pour le reste.
Bloquez ensuite quinze minutes par semaine dans votre agenda et laissez les bots faire leur propre bilan :
1Liste toutes les routines que tu as exécutées cette semaine. Pour chacune :23 - combien de fois elle s'est déclenchée4 - ce qu'elle a produit5 - ce qu'elle a ignoré, raté ou dû deviner6 - ce que tu as mis de côté pour moi sans que je réponde78Dis-moi ensuite laquelle est la moins utile, et pourquoi.9Si tu ne sais pas quel modèle a géré une étape, dis-le.
Vérifiez manuellement un résultat par routine. Un bot qui note son propre travail a les mêmes angles morts que vous.
Conclusion : le châssis est le produit
Pendant trois ans, la question était de savoir quel modèle était le meilleur. Cette semaine, le constructeur de modèles le plus agressif du marché a répondu à une autre question : quel châssis est le meilleur — avant d'y installer le cerveau d'un concurrent.
C'est ça, le basculement. Le châssis contrôle l'ordinateur, les identifiants, la mémoire et les routines. Le cerveau est interchangeable en dessous, et pour l'instant, le meilleur pour le travail d'agent est Opus 5.5.
Votre rôle ne change pas. C'est à vous de décider quoi déléguer, où s'arrête l'autorité du bot et quelles données il peut toucher. Inscrivez ces trois éléments dans la charte — et laissez le cerveau le plus puissant du marché s'occuper des clics.





