跳到正文
CHAPTER 03核心设计模式建议 40 分钟 + 动手练习

Agent 设计模式

本章目标

把透明度、控制权与一致性变成可检查的产品行为,而不只是一段“友好助手”提示词。

前置:Agent 入门框架。上游这一章的重点是 以人为中心的设计原则 ,具体的工具、规划和多 Agent 模式从后续章节展开。

补充讲解:一个会打扰人的“高效助手”

旅行助手发现便宜航班便立即下单,可能节省了点击,却剥夺了用户对日期、价格和支付的决定权。另一个助手在后台查找,把“发现了选项”“等待你确认”“已经完成”清楚区分,让用户随时停止。后者才把人的目标放在系统能力之前。

设计原则不是固定架构。原课程以空间、时间、核心三个视角组织:空间考虑触达与协作;时间考虑历史、当下与未来;核心强调不确定性、信任和控制。落实时应写成具体行为,例如“后台查价不会发送重复通知”“用户能删除偏好”“取消按钮使后续工具调用真正停止”。

原课程视频:如何设计优秀的AI Agent

原课程精读:AI Agent 设计原则

介绍

构建 AI Agent 系统有许多不同的思考方式。考虑到模糊性是生成式 AI 设计的一个特性而非缺陷,工程师们有时很难弄清从哪里开始。我们制定了一套以人为中心的用户体验设计原则,帮助开发者构建以客户为中心的 Agent 系统以满足其业务需求。这些设计原则不是一套规范性的架构,而是为定义和构建 Agent 体验的团队提供的一个起点。

一般来说,Agent 应当:

  • 扩展和放大人的能力(头脑风暴、解决问题、自动化等)
  • 弥补知识空白(让我快速了解知识领域、翻译等)
  • 促进并支持以我们个人喜好的方式与他人协作
  • 让我们成为更好的自己(例如,生活教练/任务管理者,帮助我们学习情绪调节和正念技能,建立韧性等)

本课内容

  • 什么是 Agent 设计原则
  • 实施这些设计原则时应遵循的一些指导方针
  • 使用设计原则的一些示例

学习目标

完成本课后,你将能够:

  1. 解释什么是 Agent 设计原则
  2. 说明使用 Agent 设计原则的指导方针
  3. 理解如何使用 Agent 设计原则构建 Agent

Agent 设计原则

Agent 设计原则

图:Agent 设计原则。来源:Microsoft AI Agents for Beginners,MIT。

Agent(空间)

这是 Agent 操作的环境。这些原则指导我们如何设计用于参与物理和数字世界的 Agent。

  • 连接,而非替代 — 帮助将人们与其他人、事件以及可执行的知识连接起来,促进协作和联结。
  • Agent 帮助连接事件、知识和人。
  • Agent 使人们更加紧密。它们不是用来替代或贬低人的。
  • 易于访问且偶尔隐形 — Agent 大部分时间在后台运行,只有在相关且适当时才提醒我们。
    • Agent 对授权用户来说在任何设备或平台上都易于发现和访问。
    • Agent 支持多模态输入输出(声音、语音、文本等)。
    • Agent 可以在前台与后台、主动与被动之间无缝切换,依据对用户需求的感知而定。
    • Agent 可能以隐形形式运行,但其后台进程路径及与其他 Agent 的协作对用户是透明且可控的。

Agent(时间)

这是指 Agent 如何随时间操作。这些原则指导我们如何设计在过去、现在与未来之间互动的 Agent。

  • 过去 :反映包含状态与上下文的历史。
    • Agent 基于对更丰富历史数据的分析,提供更相关的结果,而不仅限于事件、人或状态本身。
    • Agent 从过去事件中建立联系,主动反思记忆以应对当前情况。
  • 现在 :推动提醒多于单纯通知。
    • Agent 体现与人全面互动的方式。当事件发生时,Agent 超越静态通知或其他形式的正规通知。Agent 可以简化流程或动态生成提示,引导用户在恰当时刻关注重点。
    • Agent 基于环境上下文、社会文化变化及用户意图传递信息。
    • Agent 交互可以渐进、在复杂度上演变/增长,从而长期赋能用户。
  • 未来 :适应与进化。
    • Agent 适应各种设备、平台和交互方式。
    • Agent 适应用户行为、无障碍需求,且可自由定制。
    • Agent 通过持续用户交互被塑造并演变。

Agent(核心)

这些是构成 Agent 设计核心的关键元素。

  • 拥抱不确定性但建立信任
    • 预期 Agent 存在一定的不确定性。不确定性是 Agent 设计的关键要素。
    • 信任与透明是 Agent 设计的基础层。
    • 人类掌控 Agent 的开启/关闭状态,Agent 状态始终清晰可见。

实施这些原则的指导方针

使用上述设计原则时,请遵循以下指导方针:

  1. 透明度 :告知用户 AI 的参与,如何运作(包括过去的行为),以及如何反馈和修改系统。
  2. 控制 :允许用户自定义、指定偏好和个性化,控制系统及其属性(包括忘记能力)。
  3. 一致性 :追求跨设备和端点一致的多模态体验。尽可能使用熟悉的用户界面/体验元素(如麦克风图标表示语音交互),并尽可能减轻用户认知负担(如简洁回应、视觉辅助和“了解更多”内容)。

如何使用这些原则与指导方针设计旅游 Agent

想象你正在设计一个旅游 Agent,可以如下思考如何应用设计原则和指导方针:

  1. 透明度 — 让用户知道旅游 Agent 是一个 AI 驱动的 Agent。提供一些基本使用说明(如“你好”信息、示例提示)。在产品页面上清晰记录。展示用户过去提出的提示列表。明确如何反馈(点赞/点踩、发送反馈按钮等)。明确指出 Agent 是否有使用或主题限制。
  2. 控制 — 确保用户清楚如何通过系统提示等机制修改 Agent。允许用户选择 Agent 的详细程度、写作风格以及关于 Agent 不应谈论内容的任何注意事项。允许用户查看并删除相关文件或数据、提示及过去对话。
  3. 一致性 — 确保“分享提示”、添加文件或照片、标记某人或事物的图标标准且易识别。使用回形针图标表示文件上传/与 Agent 共享,使用图片图标表示图像上传。

示例代码

补充资源

从原则到一个可验收的旅行助手

把一次推荐设计为五个可观察状态:收到需求、查询中、展示候选、等待确认、完成或停止。用户在“展示候选”中修改预算,应使旧候选失效并重新查询;不能把旧价格带入最终确认。

原则实现动作验收问题
透明标明 AI 参与,显示工具查询时间和证据用户能区分推荐、查询结果和已执行操作吗?
控制查询与预订分离,保留取消和删除入口停止后是否还发出新工具请求?
一致相同状态使用相同文案与交互手机和桌面是否都能看到待确认动作?

原代码实操与解析

打开本章 03-python-agent-framework.ipynb,按准备篇安装依赖、填写 Foundry 变量并执行。原例使用 Agent 指令与工具表达设计原则;完整代码在下方导读,云端行为尚未实测。

读代码时逐项检查 instructions 是否说明角色、限制与输出方式;工具函数是否真实支持这些承诺。若指令说“可以取消”,却没有取消状态和执行器判断,功能并未实现。Python 工具的函数名和说明影响模型选择,网页上的按钮则影响用户的理解,两层都需要一致。

扩展实践,无需 API: 本站的三个模拟实验提供“下一步”和“重置”。重置会真实清空当前步骤,但不会触发外部操作;这正是一个可以验证的控制机制。

常见错误与限制

“后台不可见”不应变成“行为不可追踪”;需要可查看的执行状态和停止入口。“保持一致”不代表所有任务都用相同流程:查询是低影响读取,支付或发信是具有外部影响的动作,确认要求应与影响匹配。界面上的成功提示必须绑定工具结果,而不能仅凭模型文案。

练习与参考方案

设计“旅行偏好删除”功能,需要删除什么?

答案与参考实现

至少包括长期偏好记录、由它产生的摘要和相关缓存;保留有必要且符合法定/业务保留规则的审计记录时,应明确向用户说明范围。程序可以使用 delete_preference(user_id) 清除记录,并使 memory_version 递增以使旧缓存失效。本地综合项目的 --forget 演示按用户标签删除本地数据文件,但不是完整生产数据删除方案。

本章把设计原则转成了行为验收。下一章会进入实际工具调用,看到这些边界在哪里执行。

原课程代码与补充材料

以下是本章实际源文件对应的阅读页。Notebook 已分解为说明、代码及原文件输出;云端示例未进行联网端到端验证。正文中的片段用于解释,运行时使用完整 Notebook 和准备篇的固定依赖。

本章来源

基于 英文原文简体中文翻译 整理,原作者为 Microsoft 与开源贡献者,采用 MIT 许可证。本页标明“补充讲解”与“扩展实践”的内容为本项目新增。

来源提交:25b7985f3b2d · 获取日期:2026-09-14。参见版本校订记录

读完了,也动手试过了吗?

标记完成,记录自己的学习节奏。进度仅保存在当前浏览器。

基于 Microsoft AI Agents for Beginners · 非官方中文学习版

100%