#Agent
33 篇相关记录
AI Agent CLI 工程第 1 篇:把 Codex、Claude Code 这类终端 Agent 拆成可调度的进程合同,并用真实 Codex exec 验证工作目录、权限、JSONL、Schema、退出码、超时与输出产物。
AI Agent 工程进阶第 11 篇:用 Observe、Protect、Improve 串起生产信号、降级策略、Canary 发布与事故回归评估,并通过零依赖 Production Loop Lab 验证 9 个运行窗口。
AI Agent 工程进阶第 8 篇:区分 Context、Checkpoint、Session、长期 Memory 与业务事实源,用 Write Gate、命名空间、来源、有效期和删除规则管理 Agent 记忆,并通过零依赖 Memory Lab 验证 8 个边界案例。
AI Agent 工程进阶第 7 篇:从一次只有 tool call failed 的故障出发,讲清 Trace、Span、父子关系、版本证据与脱敏,并用零依赖 Trace Lab 检查错误上下文、安全重试、跨 Worker 恢复和敏感信息泄漏。
固定 agent-browser 与 Playwright CLI 版本,在动态 ID、DOM 重排和双视口 fixture 上比较语义快照、元素引用、命令输出与本机运行边界。
用一个可运行的 Skill 收藏页贯穿 Superpowers 的安装、触发、设计、计划、TDD、调试、Review 与验收,并从固定源码拆解 14 个 Skill、经典 Prompt 的翻译与行为机制,以及设计自己 Skill 的方法。
AI Agent 工程进阶第 6 篇:从检查点、稳定动作 ID 和错误分类讲到结果未知、回执对账、持久取消、租约与 fencing token,并在同一个 GitHub 工程中用 9 个故障案例验证 Agent Loop 能否安全恢复。
AI Agent 工程进阶第 4 篇:区分 Agent loop、Harness、RunState、对话 Session、Sandbox 与 Verifier,并在同一个 GitHub 工程中实现可替换模型接口、审批暂停与恢复、工具超时、步数上限、检查点和事件追踪。
AI Agent 工程进阶第 5 篇:从名称、描述和 JSON Schema 讲到权限、审批、预演、幂等、结构化错误、分页与工具加载,并在同一个 GitHub 工程中用 11 个边界案例比较宽工具和类型化 Tool Registry。
AI Agent 工程进阶第 3 篇:区分 Prompt、当前上下文、Session 与 Memory,设计带来源、新鲜度、权限、预算和缺失证据的 Context Packet,并用可运行实验比较“全部塞入”与受控组装。
AI Agent 工程进阶第 2 篇:在同一个 Agent Reliability Lab 中建立 20 个任务、重复 Trial、五类确定性 Grader、失败台账和发布门禁,用实际代码比较 baseline-v1 与 candidate-v2,而不是凭感觉判断新版本更聪明。
AI Agent 工程进阶第 1 篇:用一个可运行的知识库工程,把模糊的 Agent 需求拆成 Job、Input、Done、Boundary、Failure、Evidence 与 Baseline,并通过坏契约和阈值实验验证它是否真的需要 Agent。
AI Agent 工程进阶系列导读:围绕 GitHub 项目 ai-agent-learn 的企业知识库 Agent,用任务契约、评测、Context、Harness、Tool、Durable Loop、Trace、Memory、Graph、安全与 Production Loop,建立一条从 Demo 到可靠系统的 11 篇实战路线。
结合 2026 年三项 AGENTS.md 研究与 Codex 官方加载机制,解释仓库级说明为什么有时提高效率、有时增加成本,并提供规则路由表、15 分钟审计法和可复现的三条件对照实验。
用一个博客后台 Bug 示例贯穿 Context、Harness、Loop 与 Graph Engineering:解释模型看见什么、如何获得工具与边界、怎样反复行动并验证,以及何时才需要把多个局部循环组织成工作图。
AI Agent 工程进阶第 9 篇:判断何时应从 Durable Loop 升级为 Graph,设计真实依赖、隔离状态、独立验证器和预算门禁,并通过零依赖 Graph Lab 验证六个边界案例。
Codex 系列第 12 篇:从一个已经能用的 SKILL.md 出发,按真实维护压力逐步加入 references、scripts、evals 和版本记录,并分清目录、脚本、Agent 行为与人工验收各自能证明什么。
Codex 系列第 6 篇:把反复出现的项目规则从 Prompt 里拿出来,写成可维护的 AGENTS.md,并给出博客、前端、后端项目模板和自检清单。
一篇面向真实项目的 Codex 实用教程,整理入口选择、权限边界、Git 工作流、AGENTS.md、Skill/MCP、六步交付法和可复制的 Prompt 模板。