Codex 工作流:Explore → Plan → Code → Verify → Review
Codex 系列第 7 篇:把一次真实任务拆成 Explore、Plan、Code、Verify、Review 五个阶段,给出可复制的任务 checklist、Prompt 模板和验收方法。
核对来源,写清过程,保留边界。这里记录 AI 与智能体、工程实践、投资阅读, 以及那些值得回头再看的判断。
AI Agent 工程进阶第 11 篇:用 Observe、Protect、Improve 串起生产信号、降级策略、Canary 发布与事故回归评估,并通过零依赖 Production Loop Lab 验证 9 个运行窗口。
Codex 系列第 7 篇:把一次真实任务拆成 Explore、Plan、Code、Verify、Review 五个阶段,给出可复制的任务 checklist、Prompt 模板和验收方法。
AI Agent 工程进阶第 10 篇:用动作分级、Sandbox、Approval Envelope、IAM 与可恢复状态机建立 Human Control,并通过零依赖 Security Lab 验证拒绝、过期、参数漂移和重复恢复等边界。
AI Agent 工程进阶第 8 篇:区分 Context、Checkpoint、Session、长期 Memory 与业务事实源,用 Write Gate、命名空间、来源、有效期和删除规则管理 Agent 记忆,并通过零依赖 Memory Lab 验证 8 个边界案例。
AI Agent 工程进阶第 7 篇:从一次只有 tool call failed 的故障出发,讲清 Trace、Span、父子关系、版本证据与脱敏,并用零依赖 Trace Lab 检查错误上下文、安全重试、跨 Worker 恢复和敏感信息泄漏。
固定 agent-browser 与 Playwright CLI 版本,在动态 ID、DOM 重排和双视口 fixture 上比较语义快照、元素引用、命令输出与本机运行边界。
用五道安装门禁、三个代表案例和三层本地验收审计 12 个热门 Agent Skills,判断一个 Skill 是值得试用、仍需验证,还是只有热度没有闭环。