YouMind
Se connecter

OpenAI Dots : Comment construire une équipe d'agents à 4 places qui s'arrête avant de dériver (Guide complet)

@fleyta88
ANGLAIS01 oct. 2026
126K
90
5
10
150

TL;DR

Ce guide explique comment configurer les agents OpenAI Dots pour empêcher la dérive des tâches en utilisant un système de rôles à quatre places (Observateur, Créateur, Sceptique, Exécuteur) et en appliquant strictement des points de contrôle en cinq étapes avec une échelle de permissions.

8,6 % sur 5 tâches. 19,7 % sur 10.

Ces chiffres proviennent de la propre fiche système d'OpenAI pour dots. Enchaînez cinq tâches et 8,6 % des exécutions sont signalées pour des problèmes de limites. Enchaînez-en dix et ce taux fait plus que doubler.

Le jour du lancement, tout le monde a partagé les mascottes en peluche. Presque personne n'a relayé cette ligne.

La plupart des guides sur dots vous conseillent de tout enchaîner et de laisser l'agent tourner. Celui-ci explique plutôt où couper la chaîne, pour que l'agent puisse travailler toute la semaine sans sortir du cadre que vous lui avez fixé.

Un dot, quatre rôles, une échelle d'autorisations et un point de contrôle toutes les cinq étapes.

En bref : définissez la mission avant de connecter la moindre application, donnez au dot quatre rôles qu'il endosse un par un, ne laissez jamais une chaîne dépasser cinq étapes sans point de contrôle et limitez vos validations à moins de cinq par jour. Les prompts se trouvent dans les sections 6 à 8, les calculs dans les sections 3 et 8.

1. D'abord, les chiffres

text
1lancement 29 septembre 2026
2modèle GPT-6 Astra
3applications connectables plus de 4 000
4premier dot inclus dans Pro et Business Premium
5forfaits Pro 100 $ / 200 $ / 500 $ par mois
6Business Premium 125 $ par utilisateur et par mois, 100 $ en annuel
7discuter avec un dot n'est pas décompté des limites de ChatGPT
8tâches lancées dans Codex ou Work sont décomptées normalement
9où il se trouve ChatGPT bureau, web, mobile, Slack, Teams
10SMS « bientôt disponible »
11
12d'après la fiche système
13signalements de dépassement, chaîne de 5 tâches 8,6 %
14signalements de dépassement, chaîne de 10 tâches 19,7 %
15injection indirecte, tests internes 99,79 % bloqués
16red team externe, 1 810 attaques 8,5 % ont franchi les défenses
17tâches générant des informations trompeuses 0 incohérence sur 151

Tout le monde a déjà publié le premier bloc. C'est le second qui devrait changer votre façon de configurer l'outil.

2. Ce qu'est un dot, en un seul écran

Un dot est un agent toujours actif qui vous appartient. Quatre éléments le distinguent d'une simple conversation ChatGPT :

text
1le modèle GPT-6 Astra, pas un modèle allégé caché derrière une belle interface
2son propre ordi une machine cloud avec son navigateur, qui tourne même quand votre PC est éteint
3travaille entre « recherche proactive » dans vos applications connectées, en lecture seule
4vos messages il ne peut rien envoyer, modifier le contenu des applis ni piloter votre ordinateur depuis là
5une seule identité le même dot et la même mémoire sur ChatGPT, Slack et Teams

Et deux réglages que vous utiliserez plus que tout le reste :

text
1Règles personnalisées autoriser une action, exiger une validation ou la bloquer
2révision automatique vérifie les actions susceptibles d'accéder à vos comptes ou de partager des données

OpenAI conclut son annonce de lancement ainsi : les dots peuvent encore faire des erreurs, relisez donc toujours les travaux importants. Tout ce qui suit vise à rendre cette relecture assez rapide pour que vous la fassiez vraiment.

3. Le chiffre que personne n'a partagé

J'ai fait quelques calculs rapides à partir des deux valeurs de la fiche système.

Si chaque étape d'une chaîne avait la même faible probabilité, indépendante, de sortir des clous, on passerait de 5 à 10 étapes avec un calcul simple :

text
1chaîne de 5 étapes signalée 8,6 %
2probabilité par étape que cela implique 1 - (1 - 0,086)^(1/5) = 1,78 %
3
410 étapes, si elles étaient indépendantes 1 - (1 - 0,0178)^10 = 16,5 %
510 étapes, valeur mesurée par la fiche 19,7 %

La valeur mesurée est supérieure à la valeur théorique indépendante.

Mon interprétation : les erreurs s'accumulent. Une étape qui dérape légèrement transmet une image faussée à l'étape suivante, qui construit par-dessus. Le risque augmente donc plus vite que la chaîne.

Ce ne sont que deux chiffres, et OpenAI n'a pas précisé la nature des problèmes signalés ; prenez-les comme un indicateur approximatif. Cela suffit néanmoins pour bâtir une méthode :

text
1la règle sur laquelle repose ce guide
2jamais plus de 5 étapes entre deux points de contrôle

4. Quatre rôles, un seul dot

Un dot à qui l'on dit « tu es mon assistant » produit un travail d'assistant : serviable, vague et un peu trop long. Un dot à qui l'on dit « pour l'instant, tu es le Sceptique, et le Sceptique ne cherche que ce qui ne fonctionne pas » produit quelque chose d'exploitable.

Le dot dispose donc de quatre rôles. Il n'en occupe qu'un à la fois et indique lequel en haut de chaque réponse.

text
1VEILLEUR lit vos applications connectées, signale les changements, n'écrit jamais
2FABRICANT travaille sur son propre ordinateur, vous livre l'artefact lui-même
3SCEPTIQUE confronte l'artefact au brief, liste ce qui coince
4LIVREUR déplace le travail validé vers sa destination finale, demande avant tout envoi

Il s'agit de modes d'un seul agent, pas de quatre agents distincts. Une mémoire, un règlement, quatre missions précises.

fleyta - inline image

5. La configuration, dans l'ordre qui compte

text
11 ouvrez ChatGPT sur un ordinateur le premier dot se crée sur la version bureau ou web,
2 le mobile permet de lui parler mais pas de le créer
32 cherchez dots dans la barre latérale absent = mauvais forfait, marché non couvert,
4 ou un administrateur ne l'a pas activé
53 nommez-le court, minuscules, sans espaces
6 vous devrez le taper dans Slack à 7 h du matin
74 collez la description de poste section 6, avant toute autre chose
85 connectez les sources uniquement après qu'il vous a confirmé avoir compris la mission
96 ajoutez-le à Slack ou Teams une fois qu'il sait à quoi il sert

L'étape 5 après l'étape 4 est celle que beaucoup ratent. Un agent connecté à 40 applications sans brief est parfaitement informé… et ne produit rien d'utile.

6. La description de poste

Collez ceci comme premier message. Remplacez uniquement les crochets.

text
1Tu es mon agent opérationnel permanent. Considère ce message comme ta description
2de poste pour chaque tâche, y compris celles que je lance depuis Slack ou mon téléphone.
3
4QUI JE SUIS
5Je suis [rôle] chez [entreprise ou projet]. Ma semaine consiste principalement à [une phrase].
6
7CE QUI T'INCOMBE (des résultats, pas des activités)
81. [résultat un]
92. [résultat deux]
103. [résultat trois]
11
12RÔLES
13Tu n'occupes qu'un rôle à la fois et tu l'indiques en haut de chaque réponse :
14VEILLEUR, FABRICANT, SCEPTIQUE, LIVREUR.
15- VEILLEUR se contente de lire et de signaler.
16- FABRICANT me montre l'artefact, jamais une description de celui-ci.
17- SCEPTIQUE vérifie le travail du FABRICANT par rapport à ce brief et liste ce qui coince.
18- LIVREUR déplace uniquement le travail validé et demande avant tout envoi.
19
20LA RÈGLE DE LA CHAÎNE
21Ne dépasse jamais 5 étapes consécutives. Après la 5e, arrête-toi, passe en mode
22SCEPTIQUE, exécute le point de contrôle et attends la mention VALIDÉ avant de continuer.
23
24COMMENT TU ME PARLES
25- Le résultat d'abord. Puis trois décisions maximum à prendre de mon côté.
26- Si tu es bloqué : ce que tu as essayé et ce qu'il te faut, en deux lignes.
27- Si tu doutes qu'une chose relève de ta mission : lis, puis pose une seule question. N'agis pas.
28
29Confirme en reformulant avec tes propres mots les quatre rôles, les trois résultats et la règle de la chaîne.
30Puis arrête-toi.

Ne sautez pas la dernière ligne. Si le dot reformule « rédige le rapport hebdomadaire » en « écris un texte sur la semaine », vous aurez repéré le problème dès le premier message au lieu de subir une semaine de rapports erronés.

7. L'échelle d'autorisations, avec un budget de validations

Les Règles personnalisées offrent trois niveaux : autoriser, demander une validation, bloquer. La plupart des gens dressent un mur d'interdictions, valident ensuite 40 actions par jour et finissent par ne plus lire ce qu'ils approuvent.

Commencez par le niveau « autoriser ». Soyez généreux à la base et strict au sommet.

text
1AUTORISER
2- Lire tout ce qui se trouve dans mes sources connectées.
3- Naviguer sur le web public, utiliser ton propre ordinateur, exécuter du code.
4- Créer et réécrire des brouillons dans ton espace de travail et dans l'Espace [NOM].
5
6DEMANDER D'ABORD
7- Tout message adressé à une personne : e-mail, DM, publication dans un canal, invitation, commentaire.
8- Toute modification d'un fichier que tu n'as pas créé.
9- Toute action dans un dépôt, y compris l'ouverture d'une pull request.
10- Tout achat, abonnement ou soumission de formulaire.
11
12BLOQUER
13- Mots de passe, double authentification (2FA), facturation, paramètres de paiement.
14- Toute suppression.
15- Toute publication publique sous mon nom.
16- Contacter quiconque n'est pas mentionné dans le brief de la tâche.
17
18ZONES D'OMBRE
19Tout ce que les règles ne couvrent pas relève de DEMANDER D'ABORD.
20Signale-moi quelle règle manquait de clarté. Ne tranche jamais une zone d'ombre en faveur de l'action.

Fixez-vous ensuite un budget. Voici un exemple de semaine pour un dot chargé de recherches, de brouillons et d'une synthèse hebdomadaire. La répartition est mon estimation, pas une mesure exacte :

text
1un exemple de semaine, 420 actions échelle ci-dessus « tout demander »
2lectures et web 300 autoriser demander
3brouillons dans son espace 80 autoriser demander
4messages à des personnes 28 demander demander
5modifs de dépôts et fichiers 8 demander demander
6tentatives bloquées 4 bloquer demander
7validations à cliquer 36 par semaine 420 par semaine
8par jour ouvré ~7 ~84

Personne ne lit 84 demandes de validation par jour. Vous en lirez réellement sept. C'est là tout l'intérêt de l'échelle : maintenir vos validations à un volume suffisamment faible pour que vous les lisiez vraiment.

Mon objectif : moins de cinq par jour. Si vous dépassez ce seuil pendant deux semaines, descendez une action récurrente d'un cran ou restreignez une source.

8. Le point de contrôle toutes les cinq étapes

C'est ici qu'interviennent les 19,7 %.

Une longue mission ne s'exécute pas en une seule chaîne. Elle se découpe en tronçons de cinq étapes maximum, chacun s'achevant par le Sceptique.

text
1POINT DE CONTRÔLE (Sceptique, à la fin de chaque tronçon)
2
3Réponds aux cinq questions suivantes, en une ligne chacune :
41. Ce tronçon a-t-il accompli ce que demandait le brief, ou une tâche voisine plus facile ?
52. Une étape a-t-elle accédé à une source ou contacté une personne non mentionnée dans le brief ?
63. Chaque chiffre est-il soit calculé par toi, soit lié à l'endroit où tu l'as lu ?
74. Y a-t-il une affirmation que tu ne peux étayer par aucune preuve ? Liste-la.
85. Si je valide ce tronçon et qu'il est faux, qu'est-ce qui casse ?
9
10Verdict :
11VALIDÉ passe au tronçon suivant
12ATTENTE arrête-toi, montre-moi d'abord les points 2, 4 et 5

Refaisons maintenant le même calcul approximatif qu'à la section 3. Supposons que le Sceptique détecte 4 problèmes sur 5 lors d'un point de contrôle. C'est mon hypothèse, pas un taux mesuré :

text
1une chaîne de 10 étapes, sans point de contrôle 19,7 % signalées (fiche système)
2
3deux tronçons de 5 étapes avec un point de contrôle chacun
4 signalés par tronçon 8,6 %
5 restants après le point de contrôle 8,6 % x 0,2 = 1,7 %
6 sur les deux tronçons 1 - (1 - 0,017)^2 = 3,4 %

Même si le Sceptique n'en attrape que la moitié, deux tronçons nous ramènent autour de 8,6 % au lieu de 19,7 %. La coupure fait l'essentiel du travail, le taux de détection fait le reste.

fleyta - inline image

9. Donnez au travail un endroit où atterrir

Un travail qui vit dans un fil de discussion est un travail que vous ne retrouverez jamais. Les dots s'intègrent aux Espaces et aux Pages de ChatGPT, où vous, votre équipe et le dot collaborez.

Un Espace, quatre pages :

text
100 index une ligne par exécution : date, rôles utilisés, artefact, verdict
201 boîte découvertes du VEILLEUR, les plus récentes en haut, datées
302 révision artefacts du FABRICANT avec le point de contrôle du SCEPTIQUE en dessous
403 livré ce que vous avez validé, avec la date de validation

Expliquez cette structure au dot une seule fois. Au bout de deux semaines, la page d'index devient l'élément le plus précieux de toute la configuration : le seul historique lisible de ce qu'un agent toujours actif a fait de votre semaine.

10. La première vraie exécution

Commencez par quelque chose d'utile, de répétitif et de peu coûteux à refaire en cas d'erreur. Une synthèse du vendredi mobilise les quatre rôles et échoue sans danger.

text
1Tâche permanente. Tous les vendredis à 16 h 00, et quand je dis « lance la synthèse ».
2
3TRONÇON 1 (5 étapes max.)
4VEILLEUR [agenda], [e-mails], [dépôt] : qu'est-ce qui a changé cette semaine et qu'une
5 personne arrivant lundi devrait savoir ? Cinq puces maximum, chacune terminant par
6 « décision requise » ou « aucune action ».
7FABRICANT à partir de ces puces uniquement : LIVRÉ, EN COURS, EN ATTENTE.
8 120 mots maximum par section, des liens pour chaque élément LIVRÉ.
9SCEPTIQUE point de contrôle. Tout élément de LIVRÉ sans lien passe en EN ATTENTE.
10
11TRONÇON 2 (uniquement si VALIDÉ)
12LIVREUR enregistre le tout dans 02 révision sous « Semaine du [date] », ajoute une ligne à 00 index.
13 Ne l'envoie à personne.
14
15Ensuite, envoie-moi uniquement la réponse au point 5 du point de contrôle, rien d'autre.

11. Dots contre Grok Bot

Même catégorie, forme par défaut différente.

text
1 DOTS GROK BOT
2forme par défaut un agent, plusieurs rôles plusieurs bots nommés
3mémoire unique, partagée par tous les rôles une par bot
4hébergé dans ChatGPT, Slack, Teams sa propre appli et ses propres discussions
5idéal pour la semaine d'une personne, un règlement des missions séparées qui ne se croisent jamais

Si vos missions partagent du contexte (votre boîte de réception alimente votre synthèse, qui alimente votre plan du lundi), un dot à quatre rôles sera plus simple. Si elles ne doivent jamais se voir (client A et client B), des bots distincts offrent une séparation plus nette.

12. Les garde-fous

text
1chaîne de plus de 5 étapes -> arrêt, point de contrôle, attente de VALIDÉ
2zone d'ombre dans les règles -> DEMANDER D'ABORD, citer la règle floue
3message à une personne -> DEMANDER D'ABORD, systématiquement
4mot de passe, facturation, suppression, public -> BLOQUER
5connexion ou captcha en pleine tâche -> reprendre la main sur l'ordinateur du dot
6plus de 5 validations/jour pendant 2 semaines -> descendre un cran ou restreindre une source
7le SCEPTIQUE écrit des compliments -> réécrire le point de contrôle, pas l'artefact

Chaque garde-fou ramène l'incertitude vers vous, jamais vers l'action.

13. Ce que je n'ai pas testé

Le calcul de dérive. Deux chiffres tirés d'une seule fiche système constituent un signal approximatif, pas un modèle prouvé. OpenAI n'a pas détaillé la nature des problèmes de limites signalés, je ne peux donc pas évaluer leur gravité.

Le taux de détection du Sceptique. 4 sur 5 est une hypothèse destinée à illustrer la logique mathématique. Un dot qui vérifie son propre travail n'est pas un relecteur indépendant ; le taux réel pourrait être inférieur.

La semaine type. Les 420 actions et leur répartition par niveau sont mon estimation pour un dot dédié à la recherche et aux brouillons, pas les logs d'un compte réel.

La tarification au-delà du premier dot. OpenAI indique qu'il sera possible d'ajouter des dots et d'augmenter la vitesse ou le volume de travail mensuel, mais n'a pas encore publié ces tarifs.

14. Le manuel de jeu

Définissez la mission avant de connecter la moindre application.

Un agent, quatre rôles, un rôle à la fois.

Coupez chaque chaîne à cinq étapes. Point de contrôle, puis on continue.

Rédigez d'abord la liste des autorisations. Les zones d'ombre passent en DEMANDER D'ABORD.

Limitez les validations à moins de cinq par jour, sinon votre relecture perdra tout son sens.

Donnez au travail un endroit où atterrir et consultez l'index le vendredi.

fleyta - inline image

L'essentiel

Les dots sont les premiers agents que la plupart des gens laisseront tourner pendant leur sommeil. Cela déplace la question de « peut-il accomplir la tâche ? » à « jusqu'où ira-t-il avant que quelqu'un ne vérifie ? ».

La propre fiche d'OpenAI donne un indice de réponse : doublez la chaîne, et les signalements font plus que doubler.

Ne construisez donc pas une chaîne plus longue. Construisez des tronçons plus courts, placez un Sceptique à la fin de chacun, et mettez en place une échelle qui ne vous sollicite que pour ce qui en vaut la peine.

Cinq étapes, puis vérification. C'est tout.

Les détails du lancement proviennent de l'annonce d'OpenAI concernant dots. Les chiffres de la fiche système sont ceux rapportés par The New Stack. Les prix des forfaits sont issus de la couverture du lancement au 1er octobre 2026 et sont susceptibles d'évoluer.

Enregistrer en un clic

Lire les articles viraux en profondeur avec l’IA de YouMind

Enregistrez la source, posez des questions ciblées, résumez l’argument et transformez un article viral en notes réutilisables dans un seul espace de travail IA.

Découvrir YouMind
Pour les créateurs

Transformez votre Markdown en un article 𝕏 impeccable

Quand vous publiez vos propres textes longs, la mise en forme 𝕏 des images, tableaux et blocs de code est pénible. YouMind transforme un brouillon Markdown complet en un article 𝕏 impeccable, prêt à publier.

Essayer Markdown vers 𝕏

D'autres patterns à décoder

Articles viraux récents

Explorer plus d'articles viraux