让Codex攻击你的计划:claudex-loop对抗式审查循环与VERDICT机制深度解析

📅 发布时间:2026/10/3 12:50:33
让Codex攻击你的计划:claudex-loop对抗式审查循环与VERDICT机制深度解析
让Codex攻击你的计划claudex-loop对抗式审查循环与VERDICT机制深度解析【免费下载链接】claudex-loopClaude Code skill: four-phase plan hardening (recon, interrogate, Codex adversarial review, cross-model build inspection) — two AI models harden your plan before a line of code exists, then swap jobs to build it. Whoever built it never grades it.项目地址: https://gitcode.com/gh_mirrors/gr/claudex-loopclaudex-loop 是一个 Claude Code skill它让 Claude 与 OpenAI Codex 两个 AI 模型组成对抗式审查循环在写下一行代码之前先由 Codex 在只读沙箱中反复攻击你的计划每轮通过 VERDICT 机制做出 APPROVED / REVISE 二元裁决直到计划收敛。核心理念只有一条——谁写的东西谁永远不给自己打分。为什么需要对抗式审查AI 辅助编程的两个盲区AI 辅助编码最容易失败在两个地方盲区表现你 ↔ Claude双方对要造什么的理解其实没对齐Claude ↔ 它自己的产出计划看似完美但写计划的人没法客观审查它——这是典型的回音室第二个盲区尤其隐蔽让同一个模型审自己写的计划它几乎总会放行。claudex-loop 的解法是引入一个跨供应商的竞争对手模型——OpenAI Codex让它专门挑刺。项目的首次真实运行就是最好的证据一个经过深度调研、逐项确认过的 CRM 计划仍被 Codex 找出了1 个无法构建的致命架构和约 6 个会腐蚀数据的错误设计——而且当时一行代码都还没有。四阶段工作流从侦察到交叉验收你全程只需在四个点参与确认假设清单、回答审问、为收敛后的计划签字、可选批准最终代码。阶段 0 — RECON先侦察再提问Claude 在问你任何问题之前先探明地形存量项目扫架构、模块、既有模式寻找CONTEXT.md术语表和docs/adr/决策记录全新项目转向调研先行方案、技术栈、已知坑点。产出是一张假设清单Assumptions LedgerClaude 自己已解决的所有问题一次性批量呈现给你确认。这是它比连环追问式访谈最省时的一步——凡是代码或调研已经回答的问题绝不再问你。阶段 1 — INTERROGATE每个问题都要自证存在审问阶段围绕一张决策地图展开决策被分为两层承重决策Load-bearing答错要付迁移、重写或安全事故的代价如 schema、鉴权、并发、资金流——一次只问一个且每个问题必须附带三行自证为什么重要、Claude 的明确建议、猜错会坏什么外观决策Cosmetic改名即可修复的整批给出推荐答案你有异议才改。审问结束后所有对齐结果写入 PLAN.md——Goal、Approach、Key decisions、Assumptions 一个不少。核心机制拆解对抗式审查循环与 VERDICT 裁决这是 claudex-loop 的心脏值得逐行看。完整规则见 skills/codex-review/SKILL.md。只读沙箱Codex 只能读不能写审查阶段 Codex每一轮都运行在只读沙箱中首轮codex exec -s read-only ...后续轮次codex exec resume $THREAD_ID -c sandbox_moderead-only ...第二个细节是全文最关键的安全线——resume子命令不接受-s参数如果不显式强制只读Codex 会继承你本地配置的沙箱默认值可能是danger-full-access审查中途就顺手改你的文件了。skill 会自动处理这两个坑。VERDICT 机制APPROVED 或 REVISE二元裁决每轮发送给 Codex 的审查提示词核心是skills/claudex-loop/SKILL.md你是一名实现计划的对抗式审查者。怀疑一切、具体到点——你的工作是找出哪里会坏而不是好说话。找出具体缺陷安全漏洞、竞态条件、缺失的边界情况、schema 冲突、错误假设……回复的最后一行必须恰好是一行计划足以实现则输出VERDICT: APPROVED仍有实质问题则输出VERDICT: REVISE。机制上的三个巧思结构化裁决结论被约束成固定格式的一行机器可直接 grep 解析循环控制变成确定性的同会话续审第 2 轮起恢复同一个 Codex 会话通过thread_id审查者记得自己上一轮的全部发现并会回头攻击你上一轮接受的修复——它不会翻旧账但会验证修复是否真的成立有界终止MAX_ROUNDS默认 5是硬上限。到达上限仍未 APPROVED 时不伪装收敛而是把每一处未决分歧连同 Claude 的反方立场列出来交给人裁决——被标记的死锁好过假的批准。Claude 是最终仲裁者不是传声筒收到VERDICT: REVISE后Claude 逐条裁决采纳好批评拒绝坏批评——且拒绝必须写明理由并记入日志。全部无脑照办会毁掉跨模型检查的意义全部无视则审查形同虚设。辩论记录本身是交付物每轮 Codex 的完整批评 Claude 的回应都追加到PLAN-REVIEW-LOG.md。计划是做什么这份日志是为什么——整个对抗过程的可追溯凭证构建阶段还会在同一份日志下追加记录一个文件讲完整个故事。实战效果55 个发现如何收敛到 0README 中记录的首次端到端运行greenfield CRM数据轮次12345新发现数261512205 轮共 55 个发现最终VERDICT: APPROVED1 个致命问题一条读起来完全合理、但按字面无法构建的访问路径架构约 6 个数据模型错误若放行会在数周后腐蚀数据约 7 个缺失子系统包括一个没有数据源的首页功能零误伤审问阶段锁定的每条产品决策全部原样保留——审查只攻击会怎么坏不碰要造什么安装与快速上手前提条件只需一次npm install -g openai/codexlatest # Codex CLI ≥ 0.130 codex login # 任意 ChatGPT 账号即可方式 A — 插件安装推荐自动更新git clone https://gitcode.com/gh_mirrors/gr/claudex-loop # 或在 Claude Code 中执行 # /plugin marketplace add chaseai-yt/claudex-loop # /plugin install claudex-loopclaudex-loop方式 B — 手动复制到 skills 目录获得裸技能名/claudex-loop、/codex-reviewcp -r skills/* ~/.claude/skills/调用时说/claudex-loop或直接讲人话claudex this plan、stress-test this plan before we build 都能触发。已有现成计划、只想做跨模型压力测试的直接用独立的/codex-reviewskills/codex-review/SKILL.md。可调参数速查表变量默认值含义MAX_ROUNDS5审查轮次硬上限调用时可用rounds3覆盖PLAN_FILEPLAN.md计划文件位置LOG_FILEPLAN-REVIEW-LOG.md辩论记录核心交付物research询问阶段 0 调研深度none/web/deepinspecton构建后交叉验收关闭必须显式声明并留痕项目文件导航主技能四阶段全量规则skills/claudex-loop/SKILL.md独立审查循环skills/codex-review/SKILL.md术语表与 ADR 格式规范skills/claudex-loop/CONTEXT-FORMAT.md、skills/claudex-loop/ADR-FORMAT.md旧版访谈技能已被替代可作对照legacy/grill-me-codex/SKILL.md一句话总结claudex-loop 把第二个模型从可选变成制度——计划必须过 Codex 的 VERDICT代码必须由对手方验收。高风险场景鉴权、schema、并发、迁移、支付下这是目前对 AI 辅助编程回音室问题最干净的工程化答案。【免费下载链接】claudex-loopClaude Code skill: four-phase plan hardening (recon, interrogate, Codex adversarial review, cross-model build inspection) — two AI models harden your plan before a line of code exists, then swap jobs to build it. Whoever built it never grades it.项目地址: https://gitcode.com/gh_mirrors/gr/claudex-loop创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考