Ce n'est un secret pour personne : les Labs gagnent plus d'argent quand vous dépensez des tokens. Mais votre entreprise gagne quand vous livrez plus de produits et trouvez des clients payants.
L'analogie avec un casino n'est pas parfaite. Les casinos reposent sur des jeux à somme négative ; les agents IA peuvent créer une vraie valeur : un diff, un bug fix, une fonctionnalité, un après-midi de gagné. Mais l'incitation est similaire. Les Labs n'ont pas besoin que vous perdiez. Ils ont juste besoin que vous continuiez à jouer : plus de contexte, plus de réflexion, plus de tentatives, plus d'agents en parallèle. Votre outil idéal résout le problème et se retire. Un outil facturé à l'usage a tout intérêt à prolonger la session.
Voilà le casino des tokens : un logiciel utile emballé dans des mécanismes qui font passer la dépense pour du progrès. Ça commence par la plus vieille astuce du livre : abstraire l'argent.
Technique 1 : des jetons, pas des dollars
Vous ne dépensez pas des dollars. Vous dépensez des tokens.
Les tokens, c'est comme des jetons de poker. Mettez une couche entre vous et le prix, et ça ne ressemble plus à de l'argent réel. Un jeton de poker de 100 $ donne la même impression qu'un jeton de 1 $. De même, tout l'enjeu pour les Labs est que vous ne pensiez pas aux dollars quand vous lancez une exécution /goal.

Technique 2 : l'interface est une machine à sous
Je suis obsédé par la psychologie du design de produit addictif depuis que j'ai commencé à coder. Les applis de réseaux sociaux comme Facebook et Snap le font très bien depuis une décennie, mais la prochaine fois, regardez la TUI de Codex et Claude Code. Le compteur de tokens tourne. La petite animation « réflexion… » s'affiche. C'est agréable de regarder l'agent travailler.
Il y a tout un style maintenant : terminaux rétro, barres de progression clignotantes, verbes spinner qui s'activent, compteurs de tokens et de temps d'exécution en direct, tous vantés pour vous garder « dans le flow ». Comme dans un casino, il n'y a pas d'horloge au mur. Les Labs n'ont pas besoin de vous faciliter la tâche pour savoir combien vous avez dépensé. Les documents internes de Microsoft pour son nouvel assistant « Scout » mentionnaient le premier objectif en toutes lettres : rendre les gens accros.
Technique 3 : l'argent dépensé est le flex
Si vous faites attention sur X, ils transforment déjà la dépense en score et en sujet de vantardise.

Les « Profils » Codex affichent un classement des tokens : tokens à vie, tokens de pointe, séries. Ça récompense la consommation de tokens, pas le travail livré. Lors du DevDay d'OpenAI l'année dernière, OpenAI a remis des récompenses aux plus gros dépensiers en tokens, comme Cognition.
Ces récompenses sont amusantes et sympas, mais votre équipe financière se rend compte que ces factures s'accumulent. Uber aurait dépensé l'intégralité de son budget IA 2026 en quatre mois. Microsoft aurait retiré Claude Code à environ 100 000 ingénieurs.
Se faire avoir
Calvin French-Owen, un ancien ingénieur de Codex, a dit que chaque exécution ressemble un peu à un pari et en tant que personne qui a passé trop de nuits aux tables de poker et à mon bureau, je ne pourrais pas être plus d'accord. Voilà comment ça se passe généralement. L'agent rate. J'essaye à nouveau. Ça empire. J'essaye encore. Pire. J'abandonne, je suis frustré, j'ouvre une nouvelle session et je modifie le prompt : un modèle plus gros, plus de réflexion, un contexte plus propre.
À ce stade, je ne l'écris presque jamais moi-même. Je retourne à la table. Je rattrape mes pertes, et je le fais constamment, et tous ceux que je connais font pareil.
L'exécution devient bon marché
Un bon développement de produit nécessitait autrefois trois choses : un alignement serré et une exécution rapide avec une équipe de choc. L'exécution était la partie coûteuse, donc on embauchait pour ça.
L'IA a rendu l'exécution quasi gratuite. Maintenant, n'importe qui peut avoir une application fonctionnelle avant midi. Mais cela a aussi supprimé la pression qui obligeait les équipes à s'aligner avant de construire quoi que ce soit. Le résultat est un cimetière d'applications à moitié fonctionnelles que presque personne n'utilise, probablement pleines de failles de sécurité que vous allez corriger pendant des semaines.
Ce coût caché n'apparaît jamais sur le compteur de tokens. Tout le monde dit que les tokens sont bon marché et deviennent moins chers, mais c'est dans le désordre que l'argent va vraiment : les bugs, les reprises, les trucs à moitié finis dont personne n'est responsable.
Comment ne pas y laisser votre chemise
Le but de cet article n'est pas de vous dire de dépenser moins en IA. Le but est de vous faire prendre conscience que la maison gagne toujours. Plus d'entreprises devraient prendre le temps de réfléchir aux résultats de toutes ces exécutions d'agents plutôt qu'aux simples entrées brutes. Je vous laisse avec deux idées :
- Alignez d'abord vos agents. Les bonnes équipes planifient avant d'écrire du code. Si vous en laissez vingt se déchaîner et nettoyer le désordre après, votre facture s'envole. Il y a des idées intéressantes à explorer sur une meilleure coordination dans cet article.
- Payez pour les résultats. Choisissez des fournisseurs d'IA alignés avec vos incitations. Vous devriez choisir des fournisseurs qui tarifient en fonction des résultats qui vous importent, si possible, plutôt que des tokens bruts. Sierra est un bon exemple précoce pour le support client, et Crosby pour les contrats de vente.
Enfin, rappelez-vous qu'en fin de compte, les Labs vous vendent des jetons et la seule chose qui compte pour vous, c'est ce avec quoi vous repartez.





