阐释Codex、Claude Code等AI编程工具与Hermes、OpenClaw、Grok Bot等自主AI系统之间的架构层级差异,以及分层组合如何产生更强的效果。
AI translation, not an official translation. Refer to the original for technical details.
Adapted from @MichaelGannotti# 自主AI位于编程工具之上 人们总在争论Codex与Claude Code哪个更好,仿佛这就是全部。并非如此。这些产品是出色的AI工具,但它们并不是技术栈的顶端。 Hermes、OpenClaw和Grok Bot属于不同的层级,姑且称之为自主AI。它们位于工具之上,能力超出工具范畴,在需要专家的时候,它们也可以调用工具。 AI工具的作用域是某项具体工作。Codex和Claude Code在代码仓库或编程沙箱内完成规划、编辑、运行和验证,它们生来就是为了交付软件变更。这是一个困难的问题,同时也仍然是一个领域专属问题。 自主AI的作用域是一个人或一支团队。Hermes、OpenClaw和Grok Bot能够跨天保持记忆,运行在一台笔记本合盖后依然在线的机器上。它们承接跨越聊天、浏览器、桌面、日历、邮件、研究和代码的目标。编程只是它们可以调用的一种能力,而非它们用途的上限。 如果说工具是一件电动工具,那么自主AI就是决定拿起哪件工具的那个手艺人。 自主性真正新增的并非更长的提示词窗口,而是持久性。工具会话在终端关闭时消亡,自主智能体则持续保有档案记忆、技能和未完成的工作。 还有广度。工具生活在代码仓库的循环里,自主智能体则跨越应用与渠道,可以研究、起草、排期、监听,然后在路径需要时进入代码。 还有编排能力。一个编程智能体是专家,而自主层可以同时运行多个专家,在它们之间传递上下文,并在它们工作期间持续把握目标。 还有判断关卡。更好的自主系统会在高风险操作前暂停等待审批。这不是相比工具的降级,而是让某样东西持续运行、同时又不给它空白支票的方式。 以及自我扩展能力。Hermes从经验中编写技能,Grok Bot可以将一次演示转化为可复用的技能,OpenClaw通过渠道和集成成长。工具改善代码库,自主性则改善围绕代码库的操作者循环。 不要丢掉Codex或Claude Code,继续使用它们。 当任务是多文件重构、漫长的测试循环,或者需要深度代码仓库上下文的PR时,编程智能体是正确的工具。上层的意义不在于假装它在每一条shell命令上都更出色,而在于对结果负责。 一个在需要时能调用Claude Code或Codex的自主智能体,比二者单独存在时都更强大。智能体持有任务说明、约束条件和后续跟进,工具则执行精细的具体工作。 这就是我希望团队掌握的堆叠顺序:目标在顶端,专家工具在下方,人工审批守在关键边界上。 当我对这些系统进行分类时,我只问一个问题:这个东西是只在我打开代码仓库时才被唤醒,还是会在一天之中持续替我工作? 如果它只在仓库里被唤醒,它就是工具。有价值,雇它做工程任务。 如果它保持状态、监听事件、协调其他智能体,并且能将编程智能体纳入更大的计划,它就是自主AI。雇它追求结果。 Hermes是带有学习循环的开放自托管路径。OpenClaw是以渠道为核心的自托管网关路径。Grok Bot是为每个机器人配备一台计算机的托管多智能体路径。各有取舍,同属一层。 Codex和Claude Code留在工具箱里,只是不再被误认为就是工具箱本身。 这个行业至今仍在兜售那种更有礼貌的自动补全。真正的转变,是出现一个能够**承担工作所有权**的层次。 自主式 AI 位于 AI 工具之上。它之所以能做到工具做不到的事,是因为工作的基本单元不再是一个差异补丁(diff),而是一个**结果**。当交付某个结果需要调用编程专家时,这个上层就应该去调用。 这不是一场品牌之争,而是一个架构选择。去构建控制平面,保留那些强力工具,但停止将两者混为一谈。