跳到主要内容

在 API 上构建智能体

高级
What you'll learn
  • 明确智能体到底是什么:一个运行在循环中的模型
  • 运用决策测试来选择单次调用、工作流还是智能体
  • 用合适的护栏设计一个最简的智能体循环
  • 知道何时该使用 Claude Agent SDK,而不是自己手写
  • 让智能体更健壮:为其设定上限、处理失败、限制权限、对其进行评估

智能体(agent) 是一个运行在循环中的模型:它通过调用 工具、观察结果并决定下一步来追求目标,直到完成。在构建它之前,先选择 能解决问题的最简单方案

决策测试(不要过度构建)

并非每个任务都需要智能体。先沿着这棵决策树走一遍——大多数任务在最顶端就停下了。

三个选项,从最简单的开始:

  • 单次调用 — 一个提示词就能解决。适用于大多数任务。最便宜、最可靠。
  • 工作流 — 你在代码中编排一系列固定的调用(确定性的控制流)。当步骤已知时使用。
  • 智能体 — 由模型动态决定步骤。仅当路径确实无法硬编码时才使用。
Watch out

自适应 本身就是目的时才动用智能体——而不是因为它听起来很厉害。你能掌控的工作流更易于测试和调试。

设计循环

一个最简的自定义智能体只有四个活动部件。按以下顺序构建它们:

Guided walkthrough1 of 4
  1. 声明目标、约束以及可用的工具。这是模型在每一轮推理时所依据的内容。

Claude Agent SDK 为你提供了这个循环——工具、权限、上下文处理一应俱全,无需你自己手写。

Pro tip

在自己动手写循环之前,先问问 Agent SDK 是否已经涵盖了它。它内置了循环、权限和上下文处理,让你可以专注于工具和目标。

让它更健壮

一个能调用工具的循环,也可能行为失当。四个习惯能让智能体保持可信赖:

  • 为一切设定上限:迭代次数、时间、成本。智能体可能陷入循环。
  • 优雅地处理工具失败(将错误作为结果返回)。
  • 最小权限 + 人在回路 应对高风险操作——参见 保护智能体安全
  • 在信任它之前,先在真实案例上 评估 它——参见 评测
Key takeaways
  • 智能体是一个在循环中调用工具以达成目标的模型——只在路径无法硬编码时才使用它
  • 决策顺序:单次调用 → 工作流 → 智能体 → 托管智能体;优先选择能解决问题的最简单方案
  • 一个最简循环 = 系统提示词 + tool_use/tool_result 循环 + 护栏 + 上下文管理
  • Claude Agent SDK 已为你内置了循环、工具、权限和上下文处理
  • 健壮性 = 为迭代次数/时间/成本设定上限、处理工具失败、最小权限 + 人在回路,并在信任前进行评估

自我检测

自我检测

0/5
  1. 在这一语境下,哪一项最能描述智能体?
  2. 任务的步骤是固定且已知的。你应当选择什么?
  3. 自定义智能体在什么时候才真正站得住脚?
  4. 在循环中,当模型以 tool_use 作出响应时会发生什么?
  5. 以下哪一项不是让智能体保持健壮的护栏?

下一步