把成功过程提炼成模板
建议用时:25 分钟(含练习)
学习目标
能够从一次任务中分离稳定步骤、可变输入、工具依赖和人工判断点。
本节产出
一个可重复运行的工作流模板
核心知识:复用方法,而不是复制一次结果
一次任务成功后,最容易保存的是最终成品;最值得提炼的往往是如何得到它。
- 复盘:图中的复盘关注决策依据,而不是逐字保存全部聊天。可以记录为什么选择某种来源、哪个检查发现了错误、哪些步骤没有必要。
- 提取稳定步骤与变量:工作流模板把稳定步骤、可变输入、工具依赖、人工判断点和验收要求分开,让下一次任务能够沿用方法,同时适应新的资料。
- 使用第二组输入重跑:模板不必立刻自动化。先用另一组输入手工或半自动重跑,能发现原过程里隐藏的假设,例如所有资料都有日期、所有表格列名一致、所有链接都公开可访问。
- 修正异常后形成可维护模板:如果这些条件并不总成立,就需要补输入检查和异常分支。
模板越能解释关键判断,就越容易被别人正确使用。
案例:把一份每周研究简报变成模板
假设第一次简报围绕三个公开文档,包含问题、变化、影响和待核对事项。下一周换成五份不同格式资料。直接复制旧稿并替换标题,容易留下过期日期、旧结论和不适用结构。
| 内容 | 稳定部分 | 可变输入 |
|---|---|---|
| 任务合同 | 读者、用途、验收方式 | 本周研究问题与截止时间 |
| 来源筛选 | 公开可访问、相关、可核实 | 本次来源清单 |
| 证据整理 | 主张、出处、日期、限制 | 本次事实与冲突 |
| 成稿结构 | 结论、证据、影响、未知 | 本次正文 |
| 质量检查 | 引用、版本、隐私与可读性 | 本次检查结果 |
模板开头应说明输入缺失时如何处理。例如没有正文就不生成细节摘要,没有当前来源就不宣称“最新”,存在冲突就保留冲突表。异常规则让模板在困难输入上仍然诚实,而不是只对完美材料有效。
把变量变成明确字段
可以使用 研究问题、目标读者、来源列表、核验截止日期 和 输出长度 等字段。字段应有含义和示例,必要时指定必填。不要把真实人名、账号、私人路径或一次性凭证留在默认值里。
输出长度只是表达约束,不能用来迫使模型补写无证据内容。如果材料不足,模板应允许交付较短但准确的结果并说明缺口。反过来,材料复杂时也不能为了套固定段落数而隐藏重要冲突。
自动化哪些步骤,保留哪些判断
格式检查、重复链接检测和字段完整性检查通常比较容易自动化。来源是否支持结论、两个观点是否真的矛盾、读者是否能理解案例,则常需要更深入的判断。可以让 AI 辅助这些工作,但仍需设计评估与抽查。
外部发布、发送消息或修改共享数据属于另外的动作边界。模板应说明它们何时获得授权、具体目标是什么,以及如何核对结果。生成一份草稿并不自动授权把它发送给别人;模板也不能覆盖当前用户指令。
第二次运行是最小复用测试
选择结构不同但仍属于同一任务类型的输入,记录每一步是否需要人工补充。若某个步骤只适用于第一份资料,应抽象成更通用的判断,或明确缩小模板适用范围。修订后再跑原案例,避免为了适应新输入破坏已经有效的流程。
保留简短版本记录:修改原因、影响范围、验证样例和已知限制。模板不是一次写好永远不变的规则书,而是随着实际失败不断修正的方法。
动手练习
- 从一次虚构简报任务中提取五个稳定步骤和五个变量。
- 用第二组资料重跑,加入一份缺日期的文档和一对冲突说明。
- 写出模板的适用范围、异常处理和版本记录。
参考答案与推演
稳定步骤可以是确认问题、筛选来源、建立证据表、形成草稿和核查。变量包括研究问题、读者、来源、时间范围和篇幅。缺日期时标记未确认,冲突资料并列说明,不能让模板自动填入猜测值。
如果第二次运行需要完全不同的专业判断,可能已经超出模板适用范围。合格做法是说明限制或建立新方法,而不是把所有任务强行装进同一套步骤。最终模板应让另一人知道何时可用、何时需要停下来补充信息。
完成检查
- 稳定步骤、变量、依赖与人工判断分别明确。
- 第二组输入验证了真正的复用能力。
- 缺失、冲突和不可访问来源都有处理方式。
- 模板不含一次性秘密,并有版本与限制记录。
参考与来源
- Agent Skills:Specification:将方法组织为可加载技能时可参考的结构规范。
- Anthropic:Demystifying evals for AI agents:为重复任务设计结果检查与回归评估。
把成功过程提炼成模板
3 道题 · 及格分 60 分