这可不是什么秘密——实验室在你消耗更多 token 时赚得更多。但你的公司只有在你交付更多产品、获得付费客户时才能赢。
拿赌场做类比并不完美。赌场建立在负和博弈之上;AI Agent 却能创造真正的价值:一段差异、一个 bug 修复、一项功能、省下一个下午。但两者的激励机制是相通的。实验室并不需要你输,它们只需要你继续玩下去:更多上下文、更多思考、更多重试、更多并行运行的 Agent。你理想中的工具是解决问题后立刻退场,而按用量计费的工具却乐于让你一直在线。
这就是"token 赌场":看似有用的软件,却裹着让消费看起来像进步的机制。而这一切,始于最古老的把戏——让金钱变得抽象。
技巧 1:筹码,而非美元
你花的是 token,不是美元。
Token 就像扑克筹码。在价格和你之间隔上一层,它就不再像真金白银了。100 美元的筹码和 1 美元的筹码感觉没区别。同样,对实验室来说,关键就是让你在触发 /goal 运行时不会去想花了多少钱。

技巧 2:界面就是一台老虎机
从我开始编程起,我就一直痴迷于成瘾性产品设计的心理学。Facebook 和 Snap 这样的社交媒体应用已经在这方面玩得炉火纯青了十年。但下次请留心看看 Codex 和 Claude Code 的 TUI(文本用户界面)。token 计数器飞速转动,小小的"思考中……"字样在闪烁。看着 Agent 工作,感觉很爽。
现在还有这么一股风潮:复古终端、脉冲状态条、不断跳出的动词、实时 token 和运行时间计数器——所有这一切都被赞美为能让你保持"心流"。和赌场一样,墙上没有时钟。实验室根本不需要让你轻松知道自己花了多少钱。根据微软内部文档,其新 AI 助手"Scout"的第一个目标被白纸黑字地列出:让人们上瘾。
技巧 3:花钱多少就是炫耀的资本
如果你留意 X(推特),你会发现人们已经开始把消费金额变成一种分数,一种可以炫耀的东西。

Codex 的"个人资料"页面展示了 token 排行榜:累计 token、峰值 token、连续使用天数。它奖励的是消耗 token,而不是交付工作。去年 OpenAI DevDay 上,OpenAI 还向像 Cognition 这样消费万亿 token 的用户颁发了奖项。
这些奖项有趣又可爱,但你的财务团队会意识到这些账单正在不断累积。据报道,Uber 在四个月内就花光了 2026 年全年的 AI 预算。微软据称已从约 10 万名工程师手中撤回了 Claude Code 的权限。
开始上头
前 Codex 工程师 Calvin French-Owen 说,每一次运行都感觉有点像赌博。作为一个在牌桌上和办公桌前都浪费了太多夜晚的人,我完全同意。事情通常是这样发展的:Agent 没搞定,我再试一次;情况更糟,我又试一次;更糟了。我放弃,情绪上头,打开一个新的会话,修改提示词:更大的模型、更多思考、更干净的上下文。
到了这一步,我几乎从不会自己动手写代码。我只会回到牌桌上,继续追输掉的钱。我一直在这样做,我认识的每个人也都这样。
执行变得廉价
过去,好的产品开发需要三样东西:紧密对齐、快速执行加上一个顶尖团队。执行是昂贵的那部分,所以你会为此招聘人才。
AI 让执行几乎免费了。现在,任何人到午饭时间就能搞出一个能用的应用。但与此同时,它也消除了迫使团队在动手开发之前先对齐的压力。结果就是一堆半成品应用的坟墓——几乎没人用,而且很可能充满了你接下来几周都要修补的安全漏洞。
这种隐性成本永远不会出现在 token 计费表上。每个人都说 token 很便宜,而且还会越来越便宜,但真正的开销其实都花在了烂摊子上:bug、返工、那些没人负责的半成品。
如何避免血本无归
这篇文章的目的不是让你少花钱在 AI 上,而是让你意识到"庄家永远是赢家"。更多的公司应该花时间思考所有这些 Agent 运行带来的结果,而不是仅仅盯着原始输入。最后给你两个想法:
- 先让你的 Agent 对齐。 好的团队在写代码之前先做规划。如果你让二十个 Agent 到处乱跑,最后再来收拾烂摊子,你的账单就会飞涨。在这篇文章里有一些关于更好协调的有趣想法。
- 为结果付费。 选择那些与你的激励方向一致的 AI 供应商。如果可能的话,你应该选择按与你自己相关的结果定价的供应商,而不是按原始 token 定价。Sierra 是客户支持方面一个很好的早期例子,Crosby 在销售合同方面也是。
最后,请记住:实验室卖给你的不过是筹码,而真正重要的,是你最后能带着什么离开。





