工程进阶 · 可靠 Agent 的工程模式

进阶全景图

设计模式、工具、评测、长运行、安全,一张图串起来

本页解决的问题

先给结论

「进阶全景图」要解决的关键问题是什么?

设计模式、工具、评测、长运行、安全,一张图串起来

判断标准

让这个结论先证明自己值得留下。 把这一页当成决策工具,而不是需要背下来的定义。把概念连到一个真实任务、一个可观察结果,以及一个能改变你判断的失败上。

下一步

写下一个问题:试完这个方法后,你能用什么证据回答它?

常见误区

结论听起来很完整,却没有检查最关键的假设。

CHAPTER REVIEW

七大主题,一个完整的 Agent 知识体系

每一个主题都是在实际生产中验证过的工程经验。它们共同构成一套从设计到部署的完整方法论,没有一个是孤立的知识点。
设计模式
5 种 Workflow 模式(Prompt Chaining、Routing、Parallelization、Orchestrator-Workers、Evaluator-Optimizer)+ 自主 Agent。核心原则:先简单后复杂,从最简方案开始逐步升级。
先 Workflow,再 Agent
上下文工程
从 Prompt Engineering 进化到 Context Engineering。上下文窗口是稀缺资源,每个 Token 都有成本。注意力预算有限,信息的筛选和组织比信息量更重要。
注意力是稀缺资源
工具设计
ACI(Agent-Computer Interface)是 Agent 和世界的契约。四原则:给思考空间、贴近训练数据、减少格式开销、Poka-yoke 防呆。用 Agent 本身来优化工具设计。
工具设计 = Agent 的 UI
评测
三种 Grader 模式(代码、LLM、人工),三个核心陷阱(噪音、作弊、退化)。没有评测就没有优化。但评测本身也需要被评测。
No eval, no improvement
长运行 Agent
双角色 Harness 架构:脑手分离。Session 不等于 Context:上下文会超窗口、会过期、会漂移。结构化日志和检查点是保障长时间运行可靠性的关键。
Session 不等于 Context
安全
三类风险(滥用、失控、外部攻击),双层防线(模型层 + 环境层)。结构性凭证隔离:生成的代码和密钥永远不能在同一个地方。
结构性安全 > 提示词安全
检索增强
Contextual Retrieval 解决了传统 RAG 的核心问题:Chunk 脱离上下文后信息丢失。给每个 Chunk 加上下文前缀,检索失败率降低 67%。
Chunk 要自带上下文
CORE PRINCIPLES

三条核心原则

1
Do the simplest thing
that works
从最简单的方案开始。大多数问题不需要 Agent,甚至不需要 Workflow。先用一个好的 Prompt 试试,不够再加复杂度。每一层复杂度都是成本。
2
上下文是稀缺资源
每个 Token 都有成本
上下文窗口是有限的注意力预算,把它当无限垃圾桶只会适得其反。塞入无关信息不仅浪费钱,还会让模型的注意力分散,降低输出质量。少即是多。
3
结构性安全
大于提示词安全
不要依赖「在 Prompt 里告诉模型别做坏事」。通过架构设计(沙箱、凭证隔离、权限分层)让危险操作在结构上不可能发生。
内容来源:本篇章内容基于公开的 Claude Code 源码与工程博客,涵盖 Agent 设计模式、上下文工程、安全架构等主题。

「七大主题,一个完整的 Agent 知识体系」为什么能找到相关内容

「设计模式、工具、评测、长运行、安全,一张图串起来」把检索问题从“把资料存起来”推进到“怎样找到真正相关的资料”。这一步决定了 RAG、推荐和以图搜图最后交给模型的输入质量。

相似度不是答案,召回之后还要核对

在「设计模式、工具、评测、长运行、安全,一张图串起来」对应的流程里,Embedding 负责把对象放到可比较的语义空间,近邻索引负责减少搜索范围,最终的回答仍然依赖召回片段是否覆盖问题、距离指标是否合适,以及内容有没有过期。

先区分找得到和找得准

把「设计模式、工具、评测、长运行、安全,一张图串起来」落成一次小测试:准备几条有明确答案的查询,记录召回的相关性、遗漏和无关结果,再决定是否需要换切分方式、索引或重排。

从「七大主题,一个完整的 Agent 知识体系」走到「三条核心原则」

「七大主题,一个完整的 Agent 知识体系」先把问题落在「每一个主题都是在实际生产中验证过的工程经验。它们共同构成一套从设计到部署的完整方法论,没有一个是孤立的知识点。 设计模式 5 种 Workflow 模式(Prompt Chaining、Routing、Parallelization、Orchestrator-Workers、Evaluator-Optimizer)+ 自主 Agent。核心原则:先简单后复杂,从最简方案开始逐步升级。 先 Workflow,再 Age…」上;到了「三条核心原则」,讨论继续推进到「1 Do the simplest thing that works 从最简单的方案开始。大多数问题不需要 Agent,甚至不需要 Workflow。先用一个好的 Prompt 试试,不够再加复杂度。每一层复杂度都是成本。 2 上下文是稀缺资源 每个 Token 都有成本 上下文窗口是有限的注意力预算,把它当无限垃圾桶只会适得其反。塞入无关信息不仅浪费钱,还会让模型的注意力分散,降低输出质量。少即是多。 3 结构性安…」。两段连起来,重点就不只是记住一个结论,而是看清它成立所依赖的条件。

把这条判断带到下一个场景

检索系统也可以这样看:先确定什么算相关,再观察召回是否覆盖问题,最后检查排序、切分和时效性有没有把真正有用的内容挤出去。

  • 「七大主题,一个完整的 Agent 知识体系」:每一个主题都是在实际生产中验证过的工程经验。它们共同构成一套从设计到部署的完整方法论,没有一个是孤立的知识点。 设计模式 5 种 Workflow 模式(Prompt Chaining、Routing、Parallelization、Orchestrator-Workers、Evaluator-Optimizer)+ 自主 Agent。核心原则:先简单后复杂,从最简方案开始逐步升级。 先 Workflow,再 Age…
  • 「三条核心原则」:1 Do the simplest thing that works 从最简单的方案开始。大多数问题不需要 Agent,甚至不需要 Workflow。先用一个好的 Prompt 试试,不够再加复杂度。每一层复杂度都是成本。 2 上下文是稀缺资源 每个 Token 都有成本 上下文窗口是有限的注意力预算,把它当无限垃圾桶只会适得其反。塞入无关信息不仅浪费钱,还会让模型的注意力分散,降低输出质量。少即是多。 3 结构性安…

最后的「最后把结论落到实践」把讨论落到「设计模式、工具、评测、长运行、安全,一张图串起来」。回看这条线索时,最值得保留的是:当输入、规模或风险改变,哪些判断需要重新做一遍。

标记为已学完 阅读进度会自动记录
← 上一篇下一篇 →

继续阅读

同一条线上的下一篇。

文章讨论

读到这里,留下一个判断。

把刚想明白的地方、还没想通的问题,留给下一位一起学习的人。

正在讨论 进阶全景图 可靠 Agent 的工程模式
3条讨论文章讨论 · 与共学社区同步
在共学社区查看
AM
Asha Morgan内容编辑
观点实践记录

我把这篇文章里的一个判断改写成了今天可以验证的小实验。比记住结论更有用的是,知道下一步要观察什么。

文章讨论7 有帮助
LH
Lin Harper独立开发者
观点观点

读完以后我先回头找它成立的条件,而不是直接把方法搬进项目。这个顺序让后面的取舍清楚很多。

文章讨论5 有帮助
KM
Kiki Moore产品运营
问题问题

如果把这个判断放到真实工作里,最先需要补的约束是什么?我想知道从阅读到第一次实践之间,哪一步最值得先做。

文章讨论4 有帮助