#Codex
31 篇相关记录
AI Agent CLI 工程第 1 篇:把 Codex、Claude Code 这类终端 Agent 拆成可调度的进程合同,并用真实 Codex exec 验证工作目录、权限、JSONL、Schema、退出码、超时与输出产物。
AI Agent 工程进阶第 10 篇:用动作分级、Sandbox、Approval Envelope、IAM 与可恢复状态机建立 Human Control,并通过零依赖 Security Lab 验证拒绝、过期、参数漂移和重复恢复等边界。
固定 agent-browser 与 Playwright CLI 版本,在动态 ID、DOM 重排和双视口 fixture 上比较语义快照、元素引用、命令输出与本机运行边界。
用一个可运行的 Skill 收藏页贯穿 Superpowers 的安装、触发、设计、计划、TDD、调试、Review 与验收,并从固定源码拆解 14 个 Skill、经典 Prompt 的翻译与行为机制,以及设计自己 Skill 的方法。
AI Agent 工程进阶第 6 篇:从检查点、稳定动作 ID 和错误分类讲到结果未知、回执对账、持久取消、租约与 fencing token,并在同一个 GitHub 工程中用 9 个故障案例验证 Agent Loop 能否安全恢复。
AI Agent 工程进阶第 5 篇:从名称、描述和 JSON Schema 讲到权限、审批、预演、幂等、结构化错误、分页与工具加载,并在同一个 GitHub 工程中用 11 个边界案例比较宽工具和类型化 Tool Registry。
结合 2026 年三项 AGENTS.md 研究与 Codex 官方加载机制,解释仓库级说明为什么有时提高效率、有时增加成本,并提供规则路由表、15 分钟审计法和可复现的三条件对照实验。
用一个博客后台 Bug 示例贯穿 Context、Harness、Loop 与 Graph Engineering:解释模型看见什么、如何获得工具与边界、怎样反复行动并验证,以及何时才需要把多个局部循环组织成工作图。
AI Agent 工程进阶第 9 篇:判断何时应从 Durable Loop 升级为 Graph,设计真实依赖、隔离状态、独立验证器和预算门禁,并通过零依赖 Graph Lab 验证六个边界案例。
Codex 系列第 16 篇:把个人 Prompt 升级为团队可维护的 AGENTS.md、Skills、确定性检查、权限策略和责任矩阵,并用一个 PR 就绪流程演示如何验证、评审、试点与回滚。
Codex 系列第 12 篇:从一个已经能用的 SKILL.md 出发,按真实维护压力逐步加入 references、scripts、evals 和版本记录,并分清目录、脚本、Agent 行为与人工验收各自能证明什么。
Codex 系列第 10 篇:用一个完整 GitHub 任务串起 issue 拆解、本地分支、draft PR、CI、Codex Review、反馈修复、Cloud task 和最终合并,并提供可直接复用的 issue、PR 与检查清单。
Codex 系列第 6 篇:把反复出现的项目规则从 Prompt 里拿出来,写成可维护的 AGENTS.md,并给出博客、前端、后端项目模板和自检清单。
一篇面向真实项目的 Codex 实用教程,整理入口选择、权限边界、Git 工作流、AGENTS.md、Skill/MCP、六步交付法和可复制的 Prompt 模板。