可以把 AI Agent 理解为:围绕一个目标,读取上下文、决定下一步、使用工具行动,并根据结果继续调整的系统。
五个核心部分
| 部分 | 作用 | 常见风险 |
|---|---|---|
| 目标 | 定义要达到的结果 | 目标模糊导致方向漂移 |
| 上下文 | 提供文件、规则和历史 | 信息过期或来源不可信 |
| 推理 | 选择步骤和优先级 | 假设没有被明确说出 |
| 工具 | 读取或改变外部环境 | 权限过大、误操作 |
| 验证 | 判断结果是否真的完成 | 把“已尝试”当成“已成功” |
Agent 和聊天机器人的区别
聊天回答主要生成文本;Agent 还会把目标拆成动作,并与文件、浏览器、代码或服务交互。两者的边界并非绝对,关键在于它是否拥有行动能力和持续反馈回路。
使用时的判断顺序
- 这项任务的完成标准是什么?
- 哪些信息可以读取,哪些范围不应触碰?
- 哪些动作可逆,哪些动作需要人在最后确认?
- 用什么证据证明结果正确?