← 返回题库
第 228 题 · Agent · 简单

一个 LLM Agent 通常由哪些核心组件组成?

核心必会 这代表什么?
✓ 资料核验 来源说明:Datawhale 公开真实面试题整理;答案依据原论文和官方工程文档原创整理
Agent执行循环状态
评论与补充 ↓
口述训练

先用自己的话答,再看参考说法

60 秒是练习上限,不是必须凑满。原理题讲清因果,设计题讲清约束,项目题只讲真实证据。

别照着背。参考说法只用于对照;直接回答问题,简单题说清楚就收尾。项目题只用自己的经历和数字。

面试时怎么答

别只罗列“模型、工具、记忆”三个名词,最好用一次任务闭环说明各组件怎样配合:模型决策,工具产生外部效果,状态保存进度,控制器决定继续或结束,护栏约束权限。上线部分只需补上追踪、回放和人工接管;若问 Agent 与普通调用的区别,就落在控制循环和状态上。

可以这样答:

一个可用的 LLM Agent 至少包含模型、工具、任务状态或记忆、控制循环和安全护栏。模型根据当前状态选择下一步,工具连接外部系统,执行结果作为观察写回状态,控制器决定继续、重试、结束或转人工。生产环境还需要权限校验、最大步数、追踪和回放,否则系统即使偶尔成功,也很难定位失败和控制副作用。

核心回答

一个可执行任务的 Agent 通常包含目标与指令、负责决策的模型、可调用的工具、任务状态或上下文,以及控制循环。控制器把当前目标和可观察状态交给模型,模型提出下一步动作,系统校验并执行动作,再把结果作为 Observation 更新状态,直到达到完成条件、失败条件或步骤预算。Agent 是模型与运行时共同组成的系统,不只是一次 LLM 调用。

展开说明

常见组件可以这样理解:

  1. 目标与策略约束:定义任务、业务规则、允许和禁止的行为。
  2. 模型或策略:根据当前状态选择回答、提问、调用工具或结束。
  3. 工具与环境:把检索、计算、数据库和外部 API 作为受限动作暴露。
  4. 状态与上下文:保存用户输入、计划、工具结果、任务进度和必要记忆。
  5. 编排器:负责循环、路由、超时、重试、并发和终止条件。
  6. 校验与观测:检查参数、权限、结果和真实终态,并记录可回放轨迹。

不同框架的命名并不统一,组件也不一定都由模型驱动。例如权限校验和高风险确认应由确定性代码控制。

工程实践

先画清状态机和信任边界:哪些字段来自用户,哪些由服务端生成,哪些动作有副作用。为每次运行分配 run_id,保存状态转换、工具调用和最终结果;同时设置最大步骤、最大费用和取消机制,避免 Agent 无界运行。

常见追问

  1. Agent 与一次带工具的模型调用有什么区别? 单次调用只产生一次决策;Agent 有持续的状态和观察—行动循环,能根据工具结果重规划,直到完成、失败或转人工。
  2. 哪些组件必须由确定性代码控制? 身份认证、权限、金额和配额校验、幂等、状态迁移及危险动作审批不能只依赖模型判断。
  3. Agent 在什么条件下应该停止或向用户追问? 达到可验证终态应停止;缺少会实质改变结果的信息、连续失败、风险超阈值或预算耗尽时,应追问或升级人工。

一句话复习

Agent 是“模型决策、工具执行、状态更新和受控循环”的组合系统。

参考资料

无需账号 · 原地交流

评论与补充

评论会直接显示在这道题下面。可以写自己的答法、继续追问或指出错误,不需要 GitHub 账号,也不会跳转到 Issue;内容会公开,请勿填写个人隐私、公司机密或受保密约束的材料。

正在加载评论…