模型、产品、工具和 Agent 不是一回事
建议用时:25 分钟(含练习)
学习目标
能够用自己的例子解释模型、聊天产品、工具、API 与 Agent 的边界。
本节产出
一张五层 AI 概念卡片
核心知识:把一次 AI 任务拆开来看
设想你要把三份活动报名表整理成一份名单。你在聊天窗口里描述需求,AI 给出一段整理方法;你继续上传表格,它返回合并结果;如果它还能在授权后读取指定文件夹、运行去重脚本并保存文件,任务又多了一层执行能力。这三个过程看起来都叫“使用 AI”,但完成工作的部件不同。分清它们,才能知道该换模型、补材料,还是接入一个真正能执行动作的工具。
模型
模型是经过训练、能根据输入计算输出的系统。文本模型接收经过编码的上下文,生成后续内容。它可以提出“删除重复行”的方案,也可能生成一段程序,但方案本身不会自动改变你的表格。不能从一段流畅回答推断它已经读过硬盘、查询过网页或执行过命令;这些都需要相应的输入或工具记录。
产品是你实际使用的软件。它把模型、账号、界面、文件处理、搜索、存储等能力组织在一起。同一产品可能提供多个模型;同一模型也可能出现在不同产品里。产品是否支持上传、能否保留历史记录、在哪里处理数据,都不能仅由模型名称推断。学习时可以先画出“我点开的软件”和“软件调用的模型”两个方框,暂时不知道后者也没关系,写“待确认”比猜测准确。
工具
工具负责一个具体动作,例如读取文件、查询库存或执行计算。工具的关键不是名字有多智能,而是输入是什么、允许操作什么、怎样判断成功。一个计算器可以精确返回算式结果,却不负责决定这道算式是否适合你的业务。模型和工具配合时,前者提出调用请求,外部程序检查参数、权限并执行,再把结果送回模型。
API是程序交互的约定,包括请求地址、参数、认证、返回结构和错误。它既可以连接模型,也可以连接数据库、天气服务和文件系统。一款产品可以完全隐藏 API 细节;一个工具也可能通过 API 完成动作。因而 API 不是比工具“更高级”的智能层,它说明的是怎样通信,而不是谁负责决策。
Agent通常指能够围绕目标,根据观察结果选择后续动作的系统。它可以先检查表头,再发现格式不一致,调整处理方法,最后验证输出。预先写死的流水线也能自动执行很多步骤,但步骤如何选择不同:固定流程主要按照预设规则走,Agent 的部分下一步选择由模型结合当前结果决定。实际产品常把两者混合,不必强行贴唯一标签。
图中箭头表示信息和动作的传递。产品是使用入口,模型与工具可以往返多次;API 出现在连接处,Agent 描述整个决策循环。它们不是五个必须逐级购买的等级,也不构成唯一的行业分层标准。真正需要确认的是:谁看到数据、谁拥有权限、谁改变了外部状态、谁留下了证据。
案例:活动名单究竟整理到哪一步了
以下使用虚构数据。报名表甲有“林同学、周同学”,表乙有“周同学、陈同学”。你的要求是合并并去重,但没有说明同名是否代表同一人。
| 观察到的结果 | 可以得出的结论 | 还不能得出的结论 |
|---|---|---|
| AI 解释去重方法 | 模型生成了方案 | 它已经读到两份文件 |
| AI 显示三行合并名单 | 它产出了候选结果 | 同名记录一定属于同一个人 |
| 工具记录显示读取两份指定表格 | 对应文件读取动作成功 | 去重规则符合活动要求 |
| 输出文件存在且抽查通过 | 有可验证的交付物 | 文件已发送给其他人 |
正确处理方式是先确定匹配键,例如报名编号;没有稳定编号时,把疑似重复项列出来交给负责人确认,而不是擅自合并。这样,模型负责解释异常,脚本负责执行已确定的规则,使用者负责确认业务含义。模型“更聪明”并不能替代缺失的身份信息。
同样,聊天中出现“已保存”三个字并不是保存成功的证据。至少要检查文件路径、文件是否存在、能否打开以及内容是否符合要求。遇到只能输出文本的产品,就把文本作为交付物;不要把未提供的外部执行能力想象出来。
动手练习
- 选一个不含个人敏感信息的任务,例如合并两张虚构活动表。写出入口产品、模型、可能使用的工具、通信接口和是否存在自主循环。不确定的部分明确标为未知。
- 给任务写两种请求:一种只要求解释做法,另一种要求在指定测试目录生成文件。执行前确认工具确实具备相应权限;没有执行工具时只做设计,不假造执行结果。
- 制作一张证据表,逐项记录“提出方案、读取输入、生成文件、检查内容”。每一格只能填写实际观察到的证据。
参考答案与推演
一个合理答案是:聊天软件属于产品;背后被选择的语言模型属于模型;读取 CSV 和运行去重程序属于工具动作;程序调用模型服务时遵循 API;系统根据重复项检查结果决定继续询问或重新处理时,出现 Agent 式循环。
如果第二种请求最后只返回一段代码,证据表中的“生成文件”应标为未执行。若工具返回写入成功,但你没有检查内容,应标为“文件已写入,内容待核验”。这种分级记录比笼统地写“任务完成”更有用,也能帮助你定位问题究竟出在生成、执行还是验收阶段。
完成检查
- 能用自己的任务解释五个概念,并指出 API 与工具可能同时出现在同一步。
- 能区分生成了一段建议、请求了一个动作和实际完成了动作。
- 不用模型名称推断产品权限,也不把同名记录直接认定为重复人物。
- 最终概念卡包含至少一个失败例子和一个可核验证据。
参考与来源
- Anthropic:Building effective agents:了解固定工作流与自主决策的区别。
- Claude Code:How Claude Code works:查看模型、工具和执行环境如何组成实际产品。
模型、产品、工具和 Agent 不是一回事
3 道题 · 及格分 60 分