合盖还在跑:我把 Claude 规划、Codex 执行拆开了
大家好,我是珂抖屁。
前一阵我还在跟自己较劲:终端里到底该钉 Claude Code,还是钉 Codex。一人公司最怕这种「信仰式二选一」——选错了就觉得整条产线废了,选对了又会把别的壳当成叛徒。
后来我改了问题。真正该问的不是「单开哪一个 harness」,而是:谁负责想清楚,谁负责动手,活要不要停在合上的笔记本上。
Louis-François Bouchard(@Whats_AI)把这套拆法写得很直:他不再「用 Codex」当主入口;而是用 Claude Code 做规划,让 Codex 只通过 Claude 管着的 Codex MCP 去执行,再把会话丢进独立环境——笔记本合盖,任务还能继续跑;笔记和 skills 放在 Obsidian,换工具、换设备不丢上下文。公开帖本身互动很高,但我关心的不是热度,是结构。
单开一个壳,会把三种能力绑死
以前我的默认动作是:开一个壳,塞满上下文,让它既规划又改代码又自检。看起来省事,现场却经常翻车:
•规划被执行拖脏:写到一半发现路径不对,计划还在同一线程里自我辩解。
•执行被规划拖慢:明明该改文件、跑测试,壳却在复述「我理解你的目标」。
•人机耦合过紧:合盖、出门、开会,本机会话一睡,长任务就断。
一人公司没有专人盯着终端。你要的是:你走了,活还在;你回来,只验收结果。 单开一个 harness,等于把「想」「干」「守夜」塞进同一个进程——任何一环卡住,整条链停。
拆法:Claude 管意图,Codex 管动手,环境管存活

三层:规划壳 → MCP 执行 → 合盖环境
我现在的现场更接近三层,而不是两个图标之争。
第一层:规划壳。 Claude Code 适合把边界写死:目录、验收标准、不许动的文件、完成定义。它话可以多一点——规划阶段的「多一点」是成本可控的;你要的是它把坑说清楚,而不是假装已经写完。
第二层:执行通道。 Codex 不再当「我每天打开的那个 App」,而是当 被调用的执行器:通过 MCP(或等价的进程间调用)接任务、改仓库、交 diff。入口在 Claude 一侧,执行在 Codex 一侧——口令与手分开。这不是玄学,是角色分工:谁发令,谁落刀。
第三层:合盖仍在跑的环境。 本机合盖会睡,本地 CLI 会冻。公开讨论里常见几条路:远程盒 / 常开机器、云端任务、或合盖防睡工具。一人公司的硬条件只有一句——执行进程的生命周期,不能等于笔记本屏幕的生命周期。 你合盖去吃饭,Agent 还在跑测试,这才叫产线;合盖就断,那叫演示。
Obsidian(或任何你真正会写的笔记库)负责 skills 与笔记的中立存放。壳可以换,MCP 可以换,人写过的纪律不能锁死在某一个产品目录里。
现场别踩的三个坑

规划兼裁判 / 乱开权限 / MCP 万能胶
1. 规划壳兼当唯一裁判。 同一会话写了计划,又批执行是否达标,会继承计划里的盲点。重要任务我会另开一条「没见过原计划」的核对上下文,哪怕只是另一轮更冷的提示词。拆通道不等于拆偏见。
2. 为了「永远在线」乱开权限。 合盖可跑,不等于合盖可乱改生产、可扫全盘、可随便外发。独立环境要先缩权限:限定目录、限定密钥、默认只读外加白名单写。远程跑得越久,权限设计越要抠。
3. 把 MCP 当万能胶。 MCP 只是让规划壳能叫执行器;它不自动给你质量。坏计划 + 强执行 = 更快的烂 diff。入口纪律仍在人:验收标准写不清,就别按下「去执行」。
我怎么判断这套值不值得上
我会用三天小样本,不看榜单:
•同一类任务,单开壳 vs 规划+MCP 执行,你中途打断的次数谁更少;
•合盖或离开座位 30 分钟,任务是否还在推进;
•换一台设备打开笔记库,skills 是否还在,还是散落在某个壳的隐藏目录。
三项里有两项变好,就继续;一项都没有,就别为了「看起来很 Agent」硬拆。
判断钉死
我不再追求「单开一个完美 harness」。一人公司更稳的默认是:
Claude(或你信得过的规划壳)管意图与边界 → Codex(或安静的执行器)经 MCP 动手 → 独立环境保证合盖还在跑 → 笔记库保住可迁移的 skills。
壳会换,模型会换。换不掉的是:口令与手分开,存活与屏幕分开。合盖还在跑,才算你真正养了一条产线,而不是养了一个需要你时刻盯着的聊天窗口。
(信号备注:结构参考 @Whats_AI 公开帖关于 Claude 规划、Codex MCP 执行与独立环境合盖续跑的描述;互动热度以平台公开展示为准,本文不另编数字。)