如何通过追问和反馈迭代提示词
把“不满意”转换成具体、可执行的反馈,而不是不断要求“再好一点”。
提示词改进是一个测试循环:先运行最小可用提示,按预先设定的标准检查答案,指出具体差距,只修改一两个变量后重新运行。保留有效版本和失败原因,才能把偶然的好回答变成可重复流程。
- 建立提示词测试循环
- 把模糊反馈改成具体修改要求
- 保存版本和验收记录
01
先定义“好”的标准
运行前先写下三个验收点,例如事实只来自材料、邮件不超过 150 字、行动项必须有负责人。没有标准,就只能凭感觉评价。
02
一次只修正主要问题
指出哪一段、哪个字段或哪条规则没有满足,并告诉模型应该怎样改。
如果同时改任务、材料、语气和格式,你将难以判断哪项变化有效。
03
保存可复用版本
为稳定提示保留版本号、适用任务、示例输入和检查结果。换模型或任务后重新测试,不要假定旧提示永久有效。
- V1:最小提示
- V2:补充上下文
- V3:增加边界示例
- 记录:通过项、失败项、修改原因
修改前
不好,再写得好一点。
修改后
请只修改两点: 1. 第一段压缩到 60 字内; 2. 把三个行动项改为“负责人|截止时间|动作”表格。 保留原文中的数字,不增加新事实。
为什么更好:反馈指向具体位置、格式和不变量,模型知道什么要改、什么必须保留。
可复制模板
替换空白处即可使用
当前版本的问题: - 位置: - 未满足的标准: 本轮只修改: 1. 2. 必须保持不变: - 修改后请附一张自检表,逐项说明是否满足要求。
模板只是起点。请根据真实任务删除无关部分,并在提交前检查敏感信息。
动手练习 · 约 15 分钟
完成三轮小步迭代
- 运行一个最小提示并保存 V1。
- 按三个验收点找出最大问题。
- 只修改一个变量得到 V2。
- 再次检查后增加一个边界要求得到 V3。
完成检查
- 每轮都有明确改动原因
- 没有把模型自检当作最终证据
- 最终版本能在第二份输入上复现
发现问题后这样修正
每轮同时改很多内容
优先修复影响最大的一个问题。
只给情绪化评价
指出位置、标准、目标值和保持项。
只在一个输入上测试
用第二份代表性输入检查是否可复用。
常见问题
要迭代多少轮?
以任务风险和收益为准。低风险临时任务两三轮即可;重复流程应使用多份样本测试。
让 AI 自己改提示词有用吗?
可以提供候选改法,但你仍要定义目标、检查结果并决定是否采用。
为什么同一提示结果会变化?
生成具有概率性,模型、上下文和产品设置也会变化,所以要关注整体稳定性而非一次结果。