💡阅读指南

这一节不写代码,只做一件事:搞清楚这一章用什么工具开发,用什么工具运行。 11.1 讲过 Shell Engineering 的两个阶段,现在我们要把这条原则落实到第 12 章的实战中。

1.1 回看 11.1:开发阶段和运行阶段

11.1 讨论过一个核心问题:Shell Engineering 有没有开发阶段和运行阶段?

结论是有的。只不过在 Agent 时代,这两个阶段的边界被模糊了——你可以在同一个对话里开发、测试、运行,用同一个 AI 工具从头做到尾。但这不代表两个阶段不存在。

对于个人工具(比如第八章的映画系统),不分阶段没问题。因为你是开发者也是唯一用户,开发和运行混在一起,边写边用,不需要交付。

但胶囊系统不一样。这一章我们要做的,是一个可以从头到尾走完五步链路(想法→需求→SPEC→Agent开发→部署)的完整案例。它需要交付一个可复用的产物,而不是只在自己的对话里跑通。

所以,我们要把开发阶段和运行阶段分开。

1.2 开发阶段用什么:Codex 或 Qoder

开发阶段的核心任务是:写代码、调试、确保功能正确。这个阶段需要的是「强工具」——能理解复杂需求、能写大量代码、能快速迭代。

目前最合适的工具是 Codex 和 Qoder。Codex 背后是 GPT-5.6,目前算是顶尖模型。国产方面,我们推荐Qoder,这是我认为国产 编程类 Agent 做的最好的。

不管用什么 Agent,它背后的模型一定要强。执行工具是一回事儿(DeepSeek 就够,真正做复杂的开发是另一回事儿(不推荐 DeepSeek 做开发)。

所以,这一章的开发阶段,我们选择用 Codex + GPT5.6-sol来完成。初始化项目、写代码、调试,都交给 Codex。

1.3 运行阶段用什么:Hermes

开发完成之后,产物要放到一个能长期运行的环境里。

你可能会问:既然 Codex 开发能力这么强,那运行阶段能不能也直接用 Codex?

答案是:技术上可以,但我们在生产环境不推荐这么做。

现在超级 Agent 之间的界限越来越模糊。Codex 能开发,也能运行;Hermes 能运行,也能开发。它们都能理解意图、操作文件、执行命令。单纯从功能上看,把 Codex 留在运行阶段是可行的。

但我们不这么做的原因,不是技术上的,而是安全上的。

生产环境需要一个长期稳定、可预期、不依赖单一商业公司决策的运行时环境。Codex CLI 目前是开源的,但说实话,这些国外的服务商口碑都挺臭的——尤其是 OpenAI 挂着 Open 的名号行闭源的行为。

相对OpenAI、Qoder这些商业公司的产品 ,Hermes、Pi Agent 要相对好一些,毕竟是以开源起家。

1.4 但也不是绝对的

上面说的「开发用 Codex,运行用 Hermes」,是最推荐的方案。但不是唯一的方案。

如果你更习惯用 Hermes,或者你的开发环境里只有 Hermes,那用 Hermes 开发也没问题。关键不在于工具品牌,而在于模型要选顶级模型

Hermes 本身只是一个 Agent 框架,它背后接什么模型,决定了它的开发能力。如果你在 Hermes 里接上 GPT-5.6 这样的强模型,它的开发能力并不比 Codex 差多少。区别在于工具链的集成深度——Codex 对文件系统、命令执行、依赖管理的支持更原生,但 Hermes 也可以通过各种 Skill 和插件来弥补。

所以,选择逻辑可以简化成一句话:

开发阶段用强工具 + 强模型,运行阶段用稳定的 Agent 环境。

至于是 Codex 还是 Qoder、还是 Hermes 接 GPT,是你的选择。这一章我们走推荐的路线:开发用 Codex,运行用 Hermes

1.5 ■ 学点英语

中文 English 音标 说明
Codex Codex /ˈkoʊdeks/ 本章用来完成胶囊系统开发的编程 Agent
Qoder Qoder /ˈkoʊdər/ 文中作为另一种开发 Agent 介绍的工具
深度求索 DeepSeek /ˌdiːp ˈsiːk/ 文中提到的另一种模型服务
开放人工智能 OpenAI /ˌoʊpən eɪ ˈaɪ/ Codex 背后的模型和服务提供方