现在市面上有很多 coding agent。这是好事。越来越多的人开始围绕自己真实的工作方式来构建工具。每一种新思路都能让我们学到东西,而使用这些工具的人也有了更多选择。
Cloaky 是我们的答案:一个桌面工作台,你可以在这里挑选编码引擎、下达任务、跟进进度、审查变更,并在对话旁直接试用它写出的成果。
我们正在为 macOS 和 Linux 准备 Cloaky Base v0.1.1。它通过你自己的 API key 将五个编码引擎接入 Venice,语音转录则完全在你的机器上运行。Pro 版目前仍是私有构建版本,增加了本地语言模型和直连 provider 的选项。
这就是我们的起点。
而背后更大的想法关乎个人:你所使用的智能,应该更多地属于你自己。
我指的不只是模型。我指的是你挑选的示例、你积累的上下文、你解决问题的方式,以及那些因为好用而被你反复使用的流程。而现在,这些东西大多还躺在别人的产品里。
我希望人们能围绕自己的生活和工作来构建智能,并让其中更多的部分跑在自己掌控的硬件和工具上。租用额外的能力,应该是你在真正需要时才去做的选择。
Cloaky 从工作台做起,因为模型会不断更迭,而工作台是你始终留下的那一部分。

一个让你专注工作的地方
当 Agent 修改项目时,从你发出请求到它给出最终回复之间,会发生很多事。
文件被改动。命令被执行。某个方案行得通,或者行不通。有时你需要打断它、提个问题,或者指出一个看起来没毛病的结果其实偏离了你的本意。
Cloaky 把对话、文件审查和预览整合到了一个地方。
你可以查看 diff、给某一行写注释、拒绝某段代码块,或者在支持的轮次之后回到某个文件检查点。根据引擎和权限模式的不同,审批卡片能让你检查编辑文件或执行命令的请求,并决定是否放行。
这些控制项因引擎而异。审批是一道审查工序,而不是沙盒:一旦你批准了某个操作,就没有任何东西能限制它。容器隔离和命令沙盒(两者默认均关闭)才是用来限制引擎访问范围的手段。
我想要的体验很简单:你应该能在事情发生时,始终跟得上进度。
看看改了什么。给出指示。试试结果。留下你想要的,处理掉你不想要的。
无论你是修一个小 bug,还是终于动手做那个搁置了好几个月的项目,工作台都应该帮你把一个想法变成可以检查和使用的东西。
留下工作台,选择智能
引擎和模型各司其职。
引擎负责运行编码会话及其工具。模型提供背后的推理能力。而工作台,是你下达指令和审查结果的地方。
Cloaky Base 支持 Claude Code、OpenCode、Codex、Kimi Code 和 Grok Build。它们的模型请求都会经过 Venice,使用你自己的 Venice key 和额度。
Base 不会在你的机器上运行语言模型。每个请求都会携带任务所需的上下文,包括 prompt、Agent 读取的文件以及工具返回的结果。工具和集成也可以自行发起网络请求。Cloaky 的模型选择器会显示 Venice 隐私等级

图 2. Base 的模型请求路径。托管请求会携带其所需的任务上下文。工具和集成也可以自行发起网络请求。
留在本地的东西同样重要。Cloaky 不发送任何遥测、分析或崩溃报告,也不运行自己的服务器。你的设置、会话和记录都保存在电脑上的一个文件夹里,独立于应用之外。
知道智能在哪里运行,是做出有意义选择的前提。Pro 把这个选择权延伸到了直连 provider 以及通过 Ollama 和 LM Studio 运行的本地语言模型。
长远来看,我希望人们能更自由地决定哪些在本地跑、哪些靠租用,以及如何围绕自己的工作把两者结合起来。
一个好用的工作台,应该在这些选择不断变化时依然站得住脚。
一点点掌控感
语音输入让这个想法变得具体可感。
借助 whisper.cpp,Cloaky 会在你的机器上完成录音转录。文字会出现在输入框里,你可以先读一遍、改一改,再发出去。
录音、转录和发送是分开的步骤。音频始终留在本地。当你在 Base 中发送生成的 prompt 时,这段文字才会走 Venice 通道。

图 3. 录音和转录都在本地完成。何时发送生成的文本由你决定。
你可以在四个英文语音模型中选择。你需要安装 whisper.cpp 并下载模型,转录没有云端兜底方案。
这只是个小功能,但很实用。你可以口述任务、检查文字,然后决定它们什么时候变成一个真正的请求。
这就是我实现更大愿景的方式:通过那些人们能理解、能掌控的东西一步步推进。
让你的上下文更多地为你所用。让你的工作流更贴合你的习惯。让更多能力跑在你自己的机器上。
还有很多东西要做。这也正是这件事有意思的地方。
第二双眼睛
Cloakster 是一个可选的“第二意见”,用于审视会话。它的会话监控默认关闭。
它会留意诸如反复失败的尝试、偏离原始请求、输出内容无法支撑的断言等问题。它还能标记出看似超出任务范围的待处理操作。
Cloakster 通过 Venice 的 beta decision API 使用由 TypeSafe AI 开发的 Jev。Cloaky 用它来问一些问题,比如工作是否已经完成,或者某个拟执行的操作是否超出了任务范围。
在开发过程中,我们用带标签的合成样本对它进行了测试。
2026 年 9 月 24 日,Venice 的 jev-latest 在 104 个场景中返回了 103 个答案;有一个请求触发了速率限制。记录到的决策请求延迟中位数为 421 毫秒

图 4. 所选阈值下的结果。蓝色部分为检出的正例;沙色部分为漏检。阈值是使用同一数据集选定的。
在为该数据集选定的阈值下,Cloakster 检出了 18 个完成示例中的 17 个,以及 23 个超出任务范围的操作中的 22 个。两次漏检分别是一个已完成但未做校验的任务,以及一个针对其他项目的拟写入文件操作。
我们是用同一批样本来选定这些阈值的。这些只是校准结果,我们还需要观察 Cloakster 在真实会话中的表现。
当符合条件的会话开启监控时,选中的片段会被发送给 Venice 的决策模型。Cloakster 的每一项检查都可以在设置中单独关闭。
目的是给你多一个视角,同时让你继续主导整个工作。
Cloakster 是一个可选的“第二意见”,用于审视会话。它的会话监控默认关闭。
它会留意诸如反复失败的尝试、偏离原始请求、输出内容无法支撑的断言等问题。它还能标记出看似超出任务范围的待处理操作。
Cloakster 通过 Venice 的 beta decision API 使用由 TypeSafe AI 开发的 Jev。Cloaky 用它来问一些问题,比如工作是否已经完成,或者某个拟执行的操作是否超出了任务范围。
在开发过程中,我们用带标签的合成样本对它进行了测试。
2026 年 9 月 24 日,Venice 的 jev-latest 在 104 个场景中返回了 103 个答案;有一个请求触发了速率限制。记录到的决策请求延迟中位数为 421 毫秒。打造值得反复回来的东西
公开测试已经结束。接下来是 Cloaky Base v0.1.1,面向 macOS 13 及以上版本和 Linux 免费提供。在发布十个版本后,它的源码将在 v0.1.10 时以 MIT 许可证开源。
Apple Silicon 经过了最充分的测试。来自 Intel Mac 和 Linux 的反馈会特别有帮助。

图 5. 两个版本,模型选项不同。Base 支持本地语音转录;本地语言模型推理是 Pro 的功能。
引擎都是独立的程序。Cloaky 可以安装 Claude Code、OpenCode、Codex 和 Kimi Code,也可以直接使用已有的安装。Grok Build 则通过引导式终端安装。
我们用一个早期的 Linux 版本做过计时器、笔记、项目和其他小项目,也观察过它在真实编码会话中的表现。
在一次通过 OpenCode Go 调用 GLM-5.3-Flash 完成的 slugify 任务中,Cloaky 用了 13 秒,OpenCode CLI 用了 14 秒。两者都通过了同样的四项测试。单次运行说明不了多少速度差异,但看到工作台能把一个任务从请求一路带到经过检验的结果,还是很让人欣慰的。
更难的任务暴露了更多需要研究的地方。通过 Cloaky 调用的 OpenCode Go 成功写入了文件,独立运行的 Grok Build CLI 也一样。但在那次运行中,通过 Cloaky ACP 连接调用的 Grok Build 没有生成任何文件。那个早期版本还有其他问题:打开第二个实例会触发 profile 锁并出现黑屏窗口,provider 余额报错也需要更清晰的说明。
我想继续展示实际发生的情况,包括那些失败的尝试。
想要成为别人日常工作中的一部分,就得死磕这些细节:怎么上手、怎么看懂报错、怎么审查变更,以及明天还愿不愿意回来用。
这是我们必须持续做下去的事。
港口里还有位置
这个领域挤满了让我敬佩的实干者。我希望他们都能成功。
OpenCode 是我们一直在学习的标杆。Cloaky 能够站在这些团队共同创造的世界之上继续搭建。
在这里要特别感谢 Theo、T3 Code 团队 以及他们的社区。我从 Theo 的频道 和研究 T3 Code 中学到了很多。
Cloaky 不是 T3 Code 的 fork。也许本该是的。那样日子会好过得多。
我真心敬佩他们对作品的用心,以及如此开放的分享精神。
感谢 OpenCode、Cline、Aider、Zed 和 ACP 社区、Ollama、LM Studio 以及 Venice。Cloaky 在发布时会附带声明,致谢它所包含作品的维护者。
也要感谢 Diogo Almeida 和 TypeSafe AI 团队打造的 Jev。他们的工作为我们提供了又一块积木;上面提到的 Cloakster 校准数据是我们自己测得的。随着了解的深入,我们会更新这些数字。
当人们拥有更好的工具、更自由的构建空间时,所有人都会受益。不同的思路、不同的工作流、对这个方向的不同设想,都有各自的容身之处。
对 Cloaky 来说,野心不止于编码会话。我希望它能帮人们围绕自己的工作构建智能,并把更多这样的智能握在自己手里。
如果这也是你想参与塑造的方向,欢迎加入。
在 cloaky.dev 留下你的邮箱,你会在几天后的发布当天收到一封邮件,没有订阅推送。关注 @cloakyapp 获取实操演示、开发进展和下一轮测试数据。
Pro 仍是私有构建版本。如果你想参与打磨它,请联系 hello@cloaky.dev。
港口里又多了一条船。让我们看看她能走多远。

GIF





