OpenAI Developers 官方账号 7 月 14 日称,Codex 周活已经超过 700 万。
700 万说明 Codex 正在从少数开发者的尝鲜工具变成更普遍的工作方式。但真正会不会用,不看你问了多少问题,也不看你开了多少个 Agent,而看你能不能把一个真实任务交出去,再把结果验收回来。

如果你只想从这篇文章拿走一条:先把一个真实小任务写清楚,再交给 Codex。
第一步:用 3 个问题做一分钟自检
1. 最后要交付什么?
不要只写“优化一下”“帮我改好”。要写成可见结果。
例如:错误密码登录后,页面显示明确错误提示;正常登录行为保持不变。
2. 可以动哪里,不能碰哪里?
允许修改登录页、认证接口和对应测试;不改数据库结构、依赖、密钥和部署配置。
边界不是为了绑住 Agent,而是让你敢把任务真正交出去。
3. 怎样才算完成?
现有认证测试通过;错误密码场景新增测试通过;正常登录完成回归。
如果验收标准只能写成“感觉更好”,这个任务还不适合直接交给 Agent 实现。

第二步:把模糊任务改成可执行任务
模糊版本:
帮我优化登录功能。
可以直接交付的版本:
交付结果:错误密码登录后,页面显示明确错误提示;正常登录行为不变。
必要上下文:先读取现有登录页、认证接口和相关测试,不假设项目结构。
允许范围:只修改登录页、认证接口和对应测试。
禁止范围:不改数据库结构、依赖、密钥和部署配置。
验收标准:现有认证测试通过;错误密码新增测试通过;正常登录回归通过。
交付报告:列出修改文件、测试结果、未解决问题和残余风险。
失败出口:如果需要数据库迁移、生产密钥或扩大修改范围,立即停止并报告。
这 7 行不是为了把提示词写得更长,而是让交付物、修改权和停止条件都能被检查。
第三步:判断这个任务是否适合并行
只有交付、边界和验收已经写清楚,才继续判断是否要开多个 Agent。
下面 4 类任务先不要并行:
- 多个任务必须修改同一个核心文件;
- 产品目标还没确定,只是想“先做出来看看”;
- 验收标准只能写成“感觉更好”“尽量优化”;
- 涉及生产部署、数据库迁移、密钥或其他不可轻易撤回的操作。
更稳妥的做法是先让 Agent 做只读调研、列方案或补测试,把不确定性缩小,再决定怎么拆。
今天就能完成的练习
- 从待办事项里选一个 30—60 分钟能完成的真实小任务。
- 先写清交付、边界和验收,不急着发给 Codex。
- 用上面的 7 行模板补全任务,再交给 Codex 执行。
- 把任务卡和最终结果放在一起复盘:哪一行最早暴露了返工风险?
完成这个练习,比再收藏一组提示词更接近“真正会用 Codex”。
来源与口径
- “Codex 周活超过 700 万”来自 OpenAI Developers 官方动态;本文按官方账号口径引用。
- 多 Agent、并行任务、worktree 和可审查 diff 来自 OpenAI 官方的 Codex app 说明。
- 交付、边界、验收和 7 行任务模板是作者基于 Agent 工作方式整理的实践方法,不是 OpenAI 官方规范,也不构成外部团队生产率结论。
