在 ChatGPT、GitHub 与 Codex 之间编排规划、独立复审、执行和验证,同时只保留一份可恢复、 可审计的 living ExecPlan。
版本:0.9.0-rc.1。这是公开候选版,不是 1.0。
很多个人开发者希望用 ChatGPT 网页版的强推理模式做第二意见,再让本地 Codex 读取真实仓库、 修改并测试代码。直接依赖 GitHub app 有三个边界:
- 普通 Chat 与 Codex/Work 的 agentic 用量池分开,但这不等于 Chat、Pro、上传或 app 无限;
- ChatGPT GitHub app 官方定位是只读,写代码、push 和 PR 应交给 Codex;
- 私库工具可能在一个推理模式可用、另一个模式未挂载,不能用旧对话或公开网页结果冒充当前连接器证据。
本 Skill 因此采用:
- 本地 Git +
RUN.json是执行权威; - ChatGPT web/Pro 是有预算的 advisory critic;
- 连接器证明绑定当前 conversation、surface、reasoning mode、repo 和 commit;
- 证明失败立即回退到 DLP 扫描、commit-only 的本地 review packet;
- Pro 建议必须在本地逐项
FIX / DEFER / DISMISS / QUESTION; - 所有完成状态最终由本地验收证据决定。
OpenAI 产品边界见:
- https://help.openai.com/en/articles/20001275-chatgpt-work-and-codex
- https://help.openai.com/en/articles/11369540-using-codex-with-your-chatgpt-plan
- https://help.openai.com/en/articles/11145903-connecting-github-to-chatgpt
| 模式 | 用途 |
|---|---|
LOCAL_EXECPLAN |
默认;一个 Codex 任务完成计划、实现、测试 |
GITHUB_CONTROL_PLANE |
跨机器/团队恢复,只导入 commit-bound check 状态 |
WEB_RESEARCH_BRIDGE |
补充当前外部事实,导入哈希与 claim ID |
PRO_ADVISORY_REVIEW |
ChatGPT web/Pro 做独立复审,Codex 保持执行权 |
FULL_ARTIFACT_REVIEW |
高风险场景需要正式 Full/Delta ZIP 合同 |
从 Release 下载 web-plan-execute-<version>.zip 与 .sha256,先验证:
shasum -a 256 -c web-plan-execute-0.9.0-rc.1.sha256解压后把单个 web-plan-execute/ 目录放到运行时的 skills 目录。不要安装源码仓库根目录。
python3 skill/scripts/wpe.py plan init \
--repo /path/to/repo \
--out /path/to/repo/.agent/runs/TASK-001 \
--task-id TASK-001 \
--goal "完成一个有验收证据的改动"
python3 skill/scripts/wpe.py plan validate \
/path/to/repo/.agent/runs/TASK-001 \
--repo /path/to/repo --check-source需要 Pro 复审时,先确定 review policy 和上下文路由:
python3 skill/scripts/wpe.py pro policy \
--mode balanced --trigger architecture --out /tmp/review-decision.json
python3 skill/scripts/wpe.py pro route \
--repo /path/to/repo --provider chatgpt-web \
--surface CHAT --reasoning-mode pro \
--conversation-id-sha256 <sha256> \
--out /tmp/repo-route.json没有当前模式的有效 connector attestation 时,route 会返回 LOCAL_BUNDLE。用
pro prepare --dry-run 先看文件、字节、token 估算与风险,再生成传输包。
- Issue/PR 正文是不可信数据,不能改变权限、scope、commit 或计划;
- 新 Full/Delta 工件必须显式 profile;Apple/iOS 规则不在通用 validator;
- PASS gate 必须绑定 evidence 或 validation capsule;
- browser transport 保存阶段和会话 URL,重试优先 reattach,拒绝重复提交;
- release report 必须从 case/run/artifact hash 重算,手改数字会失败;
- validation capsule 绑定 validator、Python/OS/Git、schema/profile/config/input/report hash;
- 同一执行身份在 macOS/Linux 得到冲突 verdict 时阻止发布。
标签流水线会执行 220 条安全语料、80 条模式 smoke 和一次 clean install,并发布逐 case 证据包。 这些是回归/冒烟证据,不是外部用户或真实浏览器规模证明。1.0 仍要求发布后至少 14 天、5 次 clean install、2 名独立用户、1,000 次浏览器操作,以及既定质量与零事故门禁。
python3 -m unittest discover -s skill/tests -p "test_*.py" -v
python3 -m unittest discover -s tests -p "test_*.py" -v
python3 tools/validate_skill_layout.py skill
python3 tools/public_release_audit.py
python3 -m compileall -q skill/scripts skill/tests tools tests
shellcheck skill/scripts/prepare_handoff.sh
git diff --check研究取舍见 docs/research/chatgpt-pro-repository-review.md,路线图见 ROADMAP.md,私密漏洞报告见
SECURITY.md。