Claude Code 是有史以来最好的编码环境之一。
但这并不意味着每个请求都要交给 Fable 5。
大多数人使用 Claude Code 时,让每一个请求都去调用最昂贵的模型。
阅读代码、搜索文件、编写样板代码、运行测试、写文档。
这些任务没有一项需要前沿推理能力。
你这是在用核反应堆烧开水。
下面是我用的系统,可以在不改变我喜欢的外壳、 diff 引擎和用户体验的前提下,将 Claude Code 的成本降低 10 倍。
没人讨论的问题

Fable 5 每百万 token 的输入费用是 10 美元,输出费用是 50 美元。
Kimi K3 每百万 token 的输入费用是 3 美元,输出费用是 15 美元。
仅从标价上看,就便宜了 5 倍。
但实际差距更大。
K3 拥有 100 万 token 的上下文窗口——统一价格,没有长提示额外费用。
Fable 5 在处理大型仓库上下文时,费用会迅速飙升。
K3 的吞吐量也很高。
在处理大型代码库和高吞吐量任务时,K3 还会因为重复上下文命中缓存,每百万 token 仅需 0.30 美元,而不是 3 美元。
在真实会话中的数学计算:
800K 稳定的代码库上下文 + 每轮 50K 的新 token。
→ K3 带缓存:0.24 美元 + 0.15 美元 = 每轮 0.39 美元
→ Fable 5 相同上下文:每轮 8.50 美元
相同上下文。便宜了 21 倍。
这不是说 K3 比 Fable 5 更好。
而是说,在 Fable 5 大材小用的地方,K3 便宜到可以随意使用。
你实际在为什么买单

大多数开发者认为他们为 Claude Code 付费买的是 Claude。
其实不是。
他们买的是外壳。
diff 引擎、审批流程、多文件编辑、工具调用、规划功能、会话管理、以及那个让你效率提升 10 倍的用户体验。
所有这些都存在于 Claude Code 这个环境中。
而不是 Claude 这个模型。
模型只是智能层。
而智能层是可以替换的。
你可以保留 Claude Code 所有优秀的部分,然后把特定任务路由到 K3。
外壳保持不变。只有执行这些任务的模型变了。
在 Claude Code 内运行 K3 的三种方法
从最简单到最强大。
━━━
方法一:Kimi Code(5 分钟,无需配置)

Kimi Code 是他们自己的、与 Claude Code 兼容的 CLI。
同样的外壳体验,底层是 K3。每月 19 美元的订阅费。
你有每日配额,所以永远不用担心 token 计数器。
输入 token 每百万 0.60 美元(相比 Claude Code 的 3 美元),光原始 API 就便宜了 5 倍。
安装:

安装后,安装前端设计技能,避免默认丑陋的 vibe-coded 输出:

最适合:想要完全放弃 Claude Code 订阅,立即节省 80% 以上的开发者。
方法二:通过 CC Switch 在 Codex 内使用 K3(5 分钟,一个 GUI)

这是目前最简洁的设置。
CC Switch 是一个桌面 GUI 工具,用于管理 Codex 和 Claude Code 的模型配置,无需手动修改配置文件。
你添加 K3 作为提供商,打开本地路由,然后 Codex 的每个调用都会通过 K3 路由。
分步指南:
第一步:获取 Kimi API 密钥
→ 前往 platform.kimi.ai
→ 创建账户
→ 充值(即使充 10 美元也能开始)
→ 生成 API 密钥
第二步:安装 CC Switch
→ ccswitch.io → 下载对应操作系统版本
→ 这是一个 GUI 应用,直接打开即可
第三步:添加 Kimi 作为提供商
→ 打开 CC Switch
→ 选择:Codex(或 Claude Code)
→ 添加提供商 → Kimi
→ 粘贴你的 API 密钥
→ 模型:kimi-k3
→ 上下文窗口:1048576
→ 上游格式:Chat Completions
(Codex 使用 Responses API,Kimi 使用 Chat Completions,CC Switch 负责翻译——这是关键设置)
第四步:启用路由
→ 设置 → 路由 → 本地路由 → 主开关打开
第五步:打开 Codex
→ 完成。现在每个请求都通过 K3 路由。
→ 模型选择器显示 "Custom"——仅外观,功能正常
实际成本差异:
Codex 默认(GPT-5.6 Sol):每百万 token 输入约 5 美元,输出约 30 美元
通过 CC Switch 使用 K3:每百万 token 输入 3 美元,输出 15 美元
在典型的 800K 上下文会话中:Sol 花费 24 美元以上,K3 花费 2.40 美元。
单次会话便宜 10 倍。
方法三:Codex Orchestration 插件(最强大)

这就变得有趣了。
Codex Orchestration 插件允许你在同一个 Codex 会话中为不同角色分配不同的模型。
规划者、顾问、设计师、执行者。
每个角色分配不同的模型。
你不仅仅是替换模型——你是将特定类型的工作路由到最适合该工作的最便宜的模型。
安装:

仓库地址:https://github.com/Cjbuilds/Codex-Orchestration
设置示例:
为什么特别选择 K3 作为设计师:
K3 原生支持视觉和多模态输入。
它可以读取 UI 截图、理解布局、生成设计规范。
在前端工作中,它确实很强——而且输出每百万 token 只需 15 美元,而 Fable 5 需要 50 美元,因此对于任何视觉相关的工作,它都是显而易见的执行者。
我实际使用的路由规则
不复杂。简单的决策树。

规则:使用 K3,直到任务确实需要 Fable 5 的上限。
大多数任务不需要。
即使你认为需要 Fable 5 的 95% 的任务,其实也不需要。
先用 K3 测试。只有在真正遇到瓶颈时再升级。
从今天开始实际该做什么
选择适合你当前情况的路径。
如果你想要最快的胜利(5 分钟):
安装 Kimi Code。每月 19 美元。用于所有非关键任务。

如果你想要在 Codex 内使用 K3(也是 5 分钟):
安装 CC Switch。添加 K3 作为提供商。启用本地路由。

如果你想要完整的基于角色的编排:
安装 Codex Orchestration 插件。为角色分配模型。

在以上三种情况下——将你的路由规则保存到 CLAUDE.md:

那个 CLAUDE.md 块会在每个会话中加载。
路由自动发生。
你不再需要思考它。
你不是在 Claude Code 和 Kimi 之间做选择。
你是在选择使用一个昂贵的模型处理所有事情,还是智能路由,因为两者相同(有时 Kimi 甚至比 Fable 效果更好)
Claude Code 保持不变。diff 引擎保持不变。审批流程保持不变。让你效率提升 10 倍的 UX 保持不变。
只有特定任务背后的智能层发生了变化。
Fable 5 用于那 10% 真正需要它的任务。
K3 用于那 90% 不需要的任务。
账单减少 90%。
输出质量保持不变,甚至更好,因为规划阶段现在可以完全由最强模型处理,而不是浪费在样板代码上。
这就是整个系统。
如果这对你有帮助:
→ 转发给每个为 Claude Code 支付全价的开发者
→ 关注 @sairahul1 获取更多降低成本而不降低产出的系统
→ 收藏这篇文章——三种设置路径都准备好直接复制粘贴
订阅 theaibuilders.co 获取更多类似的精彩文章
我写关于 AI、产品构建以及无需你介入就能工作的系统。
━━━━━━━━━━━━━━━━━━
提到的工具:
→ Kimi Code:kimi.com/code
→ Kimi API:platform.kimi.ai
→ CC Switch:ccswitch.io
→ Codex Orchestration:github.com/Cjbuilds/Codex-Orchestration





