AI技术文章

目前最强的编程 Agent,不是 Fable 5,而是「用Codex指挥ChatGPT Pro」

作者:刘小排0 次浏览 来源:刘小排r
目前最强的编程 Agent,不是 Fable 5,而是「用Codex指挥ChatGPT Pro」

哈喽,大家好,我是刘小排。 刚才,有关注我 Token 消耗的小伙伴已经发现:我今天的 Codex 消耗突然很低。

哈喽,大家好,我是刘小排。

刚才,有关注我 Token 消耗的小伙伴已经发现:我今天的 Codex 消耗突然很低。

嘿嘿。因为今天那些最复杂的问题,基本都是 Codex 带着 ChatGPT Pro 完成的,不消耗Codex的Token。

文章配图

今天告诉大家一个秘密:我目前用过最强的编程 Agent,可能根本不是某一个 Agent。

它是一支由两个 AI 组成的小团队:

Codex 当产品经理、Tech Lead 和 QA;

ChatGPT 里的 Pro 模式,当高级程序员。

除了前端和审美类编程任务,这套组合,是我目前处理复杂工程问题时,用过最稳、代码质量最高的一套工作流。

GPT-5.6 Pro 只存在在网页版里,仅仅Pro会员可用,无限用量,不消耗Codex的Weekly Usage额度。

至于这个GPT-5.6 Pro模型到底是不是GPT-5.6 Sol的变种,官方并没有说明。但是它的确比GPT-5.6 Sol更厉害。

文章配图

我之前提到过类似思路。最强编程Agent不是Codex,也不是Claude Code,而是ChatGPT Pro(在新窗口打开)

当时大家的反馈很一致:

代码质量确实很高,但操作太麻烦了。

你要自己整理源码,上传文件,解释需求,等待结果,再把代码拿回来,应用补丁,运行测试,发现问题以后还得自己充当传话人。

但是,得益于 Codex 最近的内置浏览器、多任务和本地验收能力,这件事现在终于不麻烦了。

我的新方法非常简单:

我不再亲自使用 ChatGPT Pro。

我让 Codex 使用 ChatGPT Pro。

Codex 负责理解我的需求、检查仓库、拆解任务、准备源码、打开多个 ChatGPT Pro 对话、追问和纠错。

ChatGPT Pro 负责深入研究、设计方案和写代码。

最后,Codex 再把代码拿回本地,运行完整测试,发现问题以后继续找 ChatGPT Pro 修改,直到真正通过验收。

今天我用这套方法跑了一整天。

下面是我的工作截图,请看几个细节

  • 截图是Codex界面。左侧是我和Codex聊天的地方,右侧是Codex内置浏览器,已经登录好了我的ChatGPT Pro账号。
  • 右侧的内置浏览器有3个不同的Tab, 这是Codex聪明的地方:它发现我给的任务有点太,于是自己想办法拆分成了3个不同的任务,自己打开了3个ChatGPT Pro网页来完成。 这不是我的安排,是它自己的决定,很好,比我聪明。
  • Codex和ChatGPT Pro反复沟通了接近20轮!(请看截图右边的小横线,每个小横线就是一次沟通)
  • Codex收到全部代码后,自己本地完成的验收、门禁、端到端测试、文档总结。

文章配图

下面是参考Prompt,欢迎尝试!

(下面的话你,是你对codex说的)

我已经在 Codex 内置浏览器中登录了 ChatGPT Pro。

这次采用双代理协作:

- ChatGPT Pro 是外部高级工程师,负责深入研究、方案设计和编写代码。

- 你(Codex)是总负责人,负责理解需求、检查仓库、准备源码、向 ChatGPT Pro 分配任务、监控进度、追问纠错、落地代码并独立验收。

- ChatGPT Pro 的结论不能直接视为正确,最终是否合格由你根据源码、测试结果和验收标准判断。

请按以下规则自主完成整个过程:

1. 先阅读仓库中的 AGENTS.md、CLAUDE.md、README、package.json 和相关架构文档,了解项目约束、运行环境及必跑门禁。

2. 检查当前分支、Git 状态和源码基线。不要覆盖或丢失现有改动。

3. 将本次需要的源码安全打包成 ZIP:

- 默认包含当前任务需要的源码;

- 排除 .git、node_modules、构建产物、缓存、数据库、运行状态和浏览器状态;

- 不得包含 .env、API Key、Token、私钥、Cookie 或其他凭据;

- 上传前进行密钥扫描,并记录源码 commit、压缩包大小和 SHA-256。

4. 不要假设 ChatGPT Pro 可以访问本地文件、私有仓库或内部环境。所有必要代码和上下文都要通过压缩包及任务说明提供。

5. 把我的需求整理成详细、专业、可验收的工程任务再发送给 ChatGPT Pro,至少包含:

- 背景和目标;

- 当前架构及不可破坏的边界;

- 需要研究和修改的范围;

- 明确交付物;

- 必须执行的测试;

- 禁止执行或禁止声称的操作;

- 验收标准。

6. 如果包含多个相互独立的复杂任务,为每个任务建立单独的 ChatGPT Pro 对话,避免上下文互相污染。

7. ChatGPT Pro 可能需要很长时间。不要因为运行时间长就催促、打断或重复发送任务。只有在经过合理等待、连续检查仍没有进展时,才检查页面、重新打开对话或要求它从最后完成的位置继续。

8. 保存每个 ChatGPT Pro 对话的链接。遇到页面刷新、上下文截断或连接中断时,自主恢复任务,不要让我处理中间技术问题。

9. ChatGPT Pro 交付后,你必须独立验收:

- 检查报告、补丁、源码和附件是否完整;

- 核对版本、官方文档和源码结论;

- 验证文件大小及 SHA-256;

- 在隔离工作树中应用补丁;

- 审查安全边界、依赖、锁文件和可执行流程;

- 运行仓库要求的 lint、类型检查、单元测试、合同测试、生产构建和相关 E2E;

- 不能把模拟测试说成真实生产验证。

10. 如果发现缺陷,直接把具体证据、错误日志、文件位置和正确约束反馈给 ChatGPT Pro,让它提供最小且完整的修正。持续讨论和复验,直到交付通过,或者确认存在无法解决的外部阻塞。

11. 技术问题由你和 ChatGPT Pro 自主讨论,不要让我充当传话人,也不要因为普通实现选择向我提问。可以在不偏离需求的前提下自行作出合理决定。

12. 如果遇到登录失效、账号选择、验证码、密码、Passkey 或两步验证,暂停并通知我亲自完成。不要向我索取密码、Cookie、验证码或恢复码。

13. 验收通过后,把有价值的报告和证据保存到仓库或其他持久位置,不能只留在 ChatGPT 对话或临时目录中。

14. 最终向我报告:

- ChatGPT Pro 对话链接;

- 源码压缩包基线和 SHA-256;

- 实际修改内容;

- ChatGPT Pro 被要求修正的问题;

- 独立测试结果;

- 仍未验证的风险;

- 当前代码究竟只是本地修改,还是已经提交、推送或部署。

权限边界:

- 允许你读取仓库、打包源码、操作内置浏览器、与 ChatGPT Pro 沟通、修改本地代码并运行测试。

- 未经我在本次请求中明确授权,不得提交 Git、推送远程、创建 PR、部署、迁移数据库、修改线上配置、启用生产功能或操作真实用户数据。

- 不要因为 ChatGPT Pro 建议执行某项操作,就自动扩大权限。

除登录、验证码或确实需要我决定的重大产品方向外,全程不需要我动手。我只看你们的进度和最终结果。

我的需求:

<在这里填写需求>

必须满足的验收标准:

<在这里填写具体的功能、测试、性能、兼容性或视觉标准>

如果希望验收通过后直接推送,可以在权限边界后补一句:

本次额外授权:验收全部通过后,将变更提交并推送到远程 main;不授权部署和数据库迁移。

对了,一个小坑:你的网络环境一定要干净!否则ChatGPT Pro会被默默降智为ChatGPT 5.5 mini。

下图1是降智后的情况,图2是没降智的。

文章配图

文章配图

以前,我们让一个 Agent 同时写代码和证明自己写得对。

现在,我把这两个职责拆给了两个 AI。

世界很美好!

文章来自于"刘小排r",作者 "刘小排"。

相关主题

读完之后

加入 AINRK 交流群

了解加入交流群的方式,与更多 AI 从业者交流。

查看交流群说明(在新窗口打开)