Reference 0001
Agent 架构速查表
用一条执行闭环和八个系统层,快速定位任何 Agent 组件。
最小定义
Agent = 目标 + 上下文 + 模型决策 + 可执行动作 + 环境反馈 + 受控循环。
如果下一步完全由预先写好的代码决定,它主要是 workflow;如果模型根据当前状态动态选择下一步,它具有 agentic control。
执行闭环
1. 构建上下文目标、指令、会话、检索结果、工具描述、预算
2. 模型决策回答、调用工具、委派、请求澄清或停止
3. 策略门禁权限、参数校验、审批、预算、风险策略
4. 执行动作API、数据库、代码沙箱、浏览器、其他 Agent
5. 写回观察结果、错误和状态变化进入下一轮上下文
未完成且预算允许:5 → 1;否则输出、失败、暂停或交给人
八层架构
1. 交互层
用户、事件、API、UI;负责输入输出和身份。
2. 编排层
生命周期、循环、路由、恢复、暂停、handoff。
3. 模型层
推理与决策;模型选择、提示词、结构化输出。
4. 工具层
把决策变成外部读写;schema、adapter、sandbox。
5. 状态与记忆层
会话状态、检查点、检索、长期事实和制品。
6. 安全与治理层
最小权限、审批、数据策略、注入防御和审计。
7. 观测与评测层
trace、事件、成本、延迟、任务成功率和回归集。
8. 运行基础设施层
队列、持久执行、隔离、密钥、并发和伸缩。
常见概念归位
| 概念 | 它是什么 | 它不是什么 |
|---|---|---|
| RAG | 上下文构建中的检索机制 | 完整 Agent 或长期记忆本身 |
| MCP | Host 与工具/资源服务之间的协议 | 决策循环、编排器或多 Agent 框架 |
| Memory | 跨步骤或跨会话保存并召回状态 | 把全部聊天记录无限塞入 prompt |
| Workflow | 代码预定义控制流 | 模型动态决定所有下一步 |
| Multi-agent | 多个有边界的决策单元通过协议协作 | 自动比单 Agent 更强或更可靠 |
| Guardrail | 输入、输出、动作和运行时的约束 | 一句“请保持安全”的系统提示词 |
生产评审六问
- 哪一步必须由模型决定,哪一步可以写成确定性代码?
- 每个工具能读什么、写什么,副作用能否幂等、撤销或审批?
- 状态的事实来源在哪里,失败后从哪个检查点恢复?
- 终止条件、时间、token、金额和循环预算是什么?
- 如何知道任务真的成功,而不只是模型声称成功?
- 发生错误、越权或不确定时,如何降级并交给人?