Claude Code Harness Codex Companion Review:让 AI 互审 AI 的分步教程
【免费下载链接】claude-code-harnessClaude Code Dedicated Development Harness - Achieving High-Quality Development Through an Autonomous Plan→Work→Review Cycle项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-harness
Claude Code Harness是一套专为 Claude Code 打造的自律式开发交付框架,通过 Plan → Work → Review 的循环保证代码质量。它的Codex Companion机制可以调用 OpenAI 的 Codex CLI,让Claude 与 Codex 两个 AI 模型互相审查彼此的代码——也就是俗称的「AI 互审」。本文是一篇面向新手的分步教程:从零安装 Codex Companion,到启动双模型评审(Dual Review),再到理解安全围栏,全程无需大量编码知识,跟着做即可。
为什么 AI 互审比单一 AI 审查更可靠
让一个 AI 自己审查自己写的代码,就像自己批改自己的试卷——同一个模型往往共享同样的「盲区」:对某类边界条件不敏感、对某个 API 的误用习以为常。
Claude Code Harness 的解法很简单:换一个「脑子」来审查。
- 实现者:Claude Code(按批准的计划写代码)
- 审查者:Claude Reviewer + Codex Reviewer 并行执行,两个不同模型、两种视角
- 仲裁者:当两家意见分歧时,自动触发 TeamAgent Debate(团队智能体辩论),从规格、计划、回归、怀疑论四个角度再对一遍
评审规则细节见 dual-review.md。
3 步装好 Codex Companion:最快安装配置方法
第 1 步:克隆仓库并安装 Codex CLI
git clone https://gitcode.com/GitHub_Trending/cl/claude-code-harness cd claude-code-harness # Codex CLI 是独立工具,需要 Node.js which codex || npm install -g @openai/codex⚠️ 注意区分:Harness 本体(
harness命令)是 Go 编写的二进制,不依赖 Node.js;Codex CLI 是另一个工具,仍需 Node.js。
第 2 步:运行一键安装脚本
./scripts/setup-codex.sh --user该脚本会把 Harness 为 Codex 适配的技能(harness-plan、harness-work、harness-review 等)安装到你的用户目录,完整说明在 codex/README.md。
第 3 步:用 setup 命令确认就绪
Codex 的接入入口是代理脚本 codex-companion.sh,Harness 的所有技能都通过它(而不是裸codex exec)调用 Codex。它支持以下子命令:
| 子命令 | 作用 |
|---|---|
setup --json | 检查 Codex 是否安装就绪(返回ready: true/false) |
status | 查看任务状态 |
task --write "..." | 派发给 Codex 实现一个任务 |
review --base HEAD~1 | 让 Codex 审查指定基线以来的变更 |
adversarial-review | 对抗式审查(刻意挑刺) |
result / cancel | 查询或取消任务 |
bash scripts/codex-companion.sh setup --json # 输出 .ready = true 即表示可用启动 AI 互审:/harness-review --dual 实战教程
发起双模型评审
在 Claude Code 会话中执行:
/harness-review --dual执行流程(简化版):
- 先通过
codex-companion.sh setup --json探测 Codex 是否可用; - Claude Reviewer 按常规流程启动;
- 若 Codex 可用,同时通过
bash scripts/codex-companion.sh review --base "${BASE_REF:-HEAD~1}" --json并行发起 Codex 审查; - 等待双方结论,进行合并。
🎯 小技巧:用--dual --cursor还能引入第三个模型作为「第二意见」,组成三方评审。
什么情况会触发 TeamAgent Debate
当出现以下任一情形,Harness 不会简单「各打五十大板」,而是启动团队智能体辩论——让四个不同立场的 Agent 互相碰撞:
| 智能体 | 主攻问题 |
|---|---|
| Spec Agent | 实现与规格正本是否矛盾? |
| Plans Agent | 与 Plans.md 的任务/完成定义是否一致? |
| Regression Agent | 有没有破坏既有行为或测试? |
| Skeptic Agent | 为了放行而忽略了什么重大风险? |
触发条件:双方结论不一致、规格/计划对齐存疑、存在 critical/major 候选问题,或你显式加上--team-debate。
最终结论怎么合并(从严原则)
| 情形 | 合并结论 |
|---|---|
| 双方都 APPROVE | APPROVE |
| 任何一方 REQUEST_CHANGES | REQUEST_CHANGES(采纳更严格的一方) |
| 辩论遗留 critical/major 分歧 | REQUEST_CHANGES |
| 规格 / 计划 / 回归门禁失败 | REQUEST_CHANGES |
只有 critical 与 major 问题为 0、且分歧已解决或降级为 minor,才会得到最终的APPROVE。评审结果写入结构化的review-result.v1,含dual_review字段(双方结论 + 分歧说明),便于追溯。
安全围栏:让 AI 互审不失控
「让 AI 跑起来」容易,「让 AI 别闯祸」才是 Harness 的精髓:
- 工作区围栏(Worktree Containment):
codex-companion.sh在派发任务前后各采集一次工作区「指纹」,若检测到 Codex 试图向工作区之外的敏感路径(如$HOME)写入,直接硬停止。 - 事前裁决:每个工具调用在运行之前由 Go 内核裁决,运行地板(Runtime Floor)对计费、网络外发、密钥读取等五类操作「一票否决」且不可配置绕过。
- 建议式原则(Advisory Rule):Codex 的评审意见是「参考意见」而非事实——必须回到实际代码与测试中验证,被拒绝的结论要写明理由。详见 codex-closeout.md。
- clean 就停:评审无重大问题、测试通过、抽查通过——就到此为止,不为好看再加戏,避免过度评审消耗时间。
常见问题速答
Q:Codex 没装或不可用怎么办?/harness-review --dual会自动降级为 Claude 单独评审,流程不中断。
Q:评审结论总是偏严格?这是设计使然:合并规则取「更严格的一方」。想放行,请修掉 critical/major,而不是放宽门禁。
Q:想让 Codex 直接干活而不仅是评审?可以,bash scripts/codex-companion.sh task --write "Fix the bug"即可派发任务,effort 等级会自动按任务复杂度计算并传递。
相关资料索引
- 双评审完整规则:dual-review.md
- Codex 收尾与 advisory 原则:codex-closeout.md
- Codex 接入入口脚本:codex-companion.sh
- Codex 环境搭建参考:codex.md
- 整体架构说明:ARCHITECTURE.md
🚀 装好 Codex Companion 之后,你的下一次/harness-review --dual就是第一次真正的「AI 互审 AI」。两个模型、一份从严结论——代码质量不再依赖任何单一模型的善意。
【免费下载链接】claude-code-harnessClaude Code Dedicated Development Harness - Achieving High-Quality Development Through an Autonomous Plan→Work→Review Cycle项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-harness
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考