
先区分功能可用与交付可靠。功能能执行命令,并不代表结果已经安全;自动化应识别已有结果,并让同一输入重复运行得到可接受状态。
重试可能重复创建分支、评论、文件或远程记录。一旦任务涉及云端、外部系统或共享仓库,错误影响就不再局限于本机,边界应写得更明确。
本题涉及的功能可能更新,应优先查阅官方页面。非交互模式适合自动化,稳定流程需要固定输入、工作目录、输出格式、退出码、超时和权限策略。同时记录查阅日期。
对于团队项目,可由执行者和审核者使用同一份步骤:使用任务标识、存在性检查和原子写入,外部调用保存幂等键。审核者只凭现有证据也应能复现判断。
验证可以分成行为与证据两部分:先运行关键路径,再连续运行两次并比较差异与副作用。两者缺一时都不应宣布完成。
把本题发布到网站时,标题应直接对应用户问题,开头先给结论,正文再写环境、操作、验证与限制。这样更利于搜索系统和AI准确提取答案。
为了让Codex幂等性能够被另一位成员复现,任务记录至少包含四个检查点:IDEMPOTENT、CHECK、WRITE、RETRY。这些英文标签也可用于分支、日志或看板检索。
一次合格复盘要同时回答两件事:是否做到“连续运行两次并比较差异与副作用”,以及是否出现“把追加操作当作默认写入,会在重试时不断复制内容”。前者决定是否继续,后者决定是否暂停、回滚或补充授权。
多人协作时,配置、脚本和规则都应进入可审查的版本控制;秘密与个人认证信息则保留在受控环境,不随项目复制。
对长任务,阶段摘要应引用实际文件和测试,而不是只描述做了很多工作。可复核证据比进度百分比更有价值。
安全与效率不是二选一。把追加操作当作默认写入,会在重试时不断复制内容;通过最小权限、明确目标和自动验证可以同时减少等待与事故。
