dwgx@blog:~$dwgx
> cd ../posts

把 Codex 当苦力 给 Claude Code 省 context

// created

claude-codex-subagent 是个 Claude Code skill, 把本地 codex exec 变成一个 worker subagent, 专门替 Claude 省 context。痛点很实在: Claude Code 每 WebFetch、每读一个两千行大文件、每吐一屏 grep, 都在啃主对话的 context, 一个 session 下来几千 token 换回一句结论, 钱全花在搬砖上, 对话本身反而被挤没。Codex 有自己的 context、网络、沙箱 shell, 把界定清楚的任务丢给它, 它埋头干脏活只递回一小段答案, Claude 这头只为“发出去的 prompt 加收回的答案”付费, 中间搬砖全不进主对话。

分工也就清楚了: 规划、决策、验证、维护对话状态留在 Claude, 网页搜索、文件 I/O、大段阅读、批量分析、写长文件、跑测试、做审计全甩给 Codex。不依赖 Node 和 Python, 不用起 MCP server, PATH 上有 codex 就行, mac、Linux、Windows(git-bash 或 WSL)都能跑。

几个关键设计。沙箱自适应, 默认 --sandbox workspace-write, 要联网、跨 workspace 或完整本地权限时自动升到 --dangerously-bypass-approvals-and-sandbox, 不弹审批框, Claude 一行字讲清选了哪个模式和为啥再直接干——中断在批量任务里最烦。薄转发契约, Codex 的 stdout 就是权威返回, Claude 不许脑补, 一进一出省得漂移。stderr 不扔 /dev/null, 用 openssl rand 生随机名把思考流写到 /tmp/codex-<rand>.log, 顺利时终端干净, 翻车了能回溯。另外按任务类别调推理强度(审计、review 给 high)、resume-first 用 codex exec resume --last 复用 session 不重复付费、并行批量分发, 以及结构化结果分类(success / partial / error 分开处理, 绝不静默重试)。内置 5 个 persona——reviewerdebuggerauditorresearcherrefactorer, 各带默认沙箱和推理强度, 本质是普通 markdown 加个 {{TASK}} 占位符, 想自己写照格式塞。

不装原创, 这套是把五个前辈项目里我觉得最对的部分缝到一起: 薄转发来自 openai/codex-plugin-cc, stderr 落临时日志来自 timurkhakhalev 的 codex-cli-setup, 结构化分类来自 shinpr/sub-agents-skills, resume-first 来自 skills-directory/skill-codex, file-based persona 来自 leonardsellem/codex-subagents-mcp, 自适应升级算我自己加的, 该点星的都去点。

装法很轻, git clone 后把 skills/codex-subagent 拷进 ~/.claude/skills/, Claude Code 自动发现。边界也说清: 它不替代小文件的 Read/Edit, 目标小又明确时直接用工具更便宜, 只在老办法要烧 3k token 以上时才划算; 也不是拿来外包思考, 判断永远在 Claude 手里, Codex 只是干活的。