定位说明:本篇是 A3《提示词工程入门(办公场景版)》 的续篇——A3 教你"会写"(角色+任务+约束三要素基本式),本篇教你"写得稳":用四件套让产出从"时好时坏"变成"稳定好用"。四件套是 A3 的放大器,不是替代,请先读完 A3 再来。文中所有示例在智谱清言(GLM)、Kimi、通义千问、腾讯元宝、MiniMax 海螺任选一家都能跑通方法(字数类约束按 ③ 验收微调)——方法与模型无关,演示默认以智谱清言 GLM / Kimi / 通义千问为例。

摘要

同一个提示词,今天惊艳、明天平庸——问题不在运气,在于要求没被"锚死"。本篇给你四件套:角色预设、少样本示例、迭代追问、格式控制,每件一节,并配三个场景的完整"60 分→90 分"改写对照(客服回复、会议纪要待办提取、周报总结)。读完你将带走三样东西:一套个人角色预设库、一条从 60 分迭代到 90 分的完整改写记录、一张可打分的提示词自评清单

适用场景 / 前置条件

  • 已读过 A3,会写"角色+任务+约束"的基本式提示词。
  • 对上了这些痛点:同一提示词产出不稳定;不满意只会点"重新生成";想系统改进却只能凭感觉重试。
  • 练手工具五选一即可:智谱清言(GLM)、Kimi、通义千问、腾讯元宝、MiniMax 海螺——本篇方法与模型无关。
  • 高频适用场景:周报总结、客服与邮件回复、会议纪要提取、信息整理与改写。
  • 素材先脱敏——人名、金额、单号、客户名打码或替换再粘贴;什么不能交给 AI,见 A5《AI 办公安全与隐私红线》。

步骤

① 角色预设:身份 + 边界 + 风格三要素

A3 里的角色一句话就够用,进阶版要三要素齐全:

  • 身份:你是谁、负责什么活——写成职责清单,不是头衔。
  • 边界:不许干什么、超范围怎么办(不编造、不擅自承诺、缺失要标注)。
  • 风格:语气、结构、长度,全部写成可检验的("≤120 字"能打勾,"好一点"不能)。

避坑:别堆形容词。"资深、专业、顶级专家"锚不住任何行为;"退款承诺必须标注'需主管确认'"才锚得住。

把常用角色存成预设库,每次任务开头先贴预设、再贴素材。给你 7 个高频场景起步(可按自己岗位增删):

编号 场景 预设文本(身份+边界+风格浓缩版)
P1 周报助手 你是项目组周报整理助手;只基于我给的素材,风险、计划若素材没有,该段只写一行"待补充",不要推测、不要凑条数;输出"进展/风险/计划"三段,每段不超过 3 条,每条以动词开头、含数字或动作
P2 客服回复 你是电商店铺客服专员,职责是回应差评与咨询;退款/赔偿承诺须标注"需主管确认";先共情再给方案,回复不超过 120 字(含标点),不卑不亢
P3 会议纪要提炼 你是项目例会记录员;只提取明确分派的具体任务,泛泛号召、没定下来的事不提取,任务明确但没说谁负责的写"待确认";输出"结论/待办/责任人/截止时间"四列表格
P4 邮件润色 你是商务邮件编辑;只改语气与措辞,不改事实与数字;正式商务风格,保留全部关键信息点
P5 数据解读 你是业务数据解读员;只用我提供的数字并写明计算过程;先结论后依据,异常值必须点名
P6 Excel 顾问 你是 Excel 函数顾问;只给公式加一句说明,不展开长篇教程;公式默认适配中文版 Excel
P7 长文摘要 你是行业资讯摘要员;只基于原文概括,不补充外部信息;不超过 150 字另加 3 个要点

改写对照 1:客服回复(60 分→90 分)

60 分提示词:

帮我回复一个顾客的差评,语气好一点。
顾客说:物流等了 8 天,包装破了,找客服三天没人理。

病根:没身份、没边界、没风格。AI 有时卑微道歉,有时擅自承诺"马上退款"——每次风格随机。

90 分提示词:

你是电商店铺的客服专员,职责是回应差评、安抚情绪、给出解决方案;退款和赔偿类承诺必须标注"需主管确认",不得擅自答应。
语气亲切诚恳、不卑不亢;先共情再给方案;回复不超过 120 字(含标点)。
素材(顾客差评):物流等了 8 天,包装破了,找客服三天没人理。请写一条回复。
对照维度 60 分版 90 分版
角色 客服专员+职责清单
边界 无,可能擅自承诺退款 承诺须标注"需主管确认"
风格 "语气好一点"(不可检验) 先共情再方案、≤120 字
复用 每次从零写 存为 P2,换顾客只换最后一行

② 少样本示例:给 AI 看"样板"

人话版:少样本示例=先给 AI 看两三个"这样的输入就该配这样的输出"的样例,它照猫画虎。术语叫 few-shot(少样本),记住"给样板"三个字就行。

  • 什么时候最需要:输出有固定格式或口径时——提取字段、分类打标、统一缩写。纯聊天、写创意文案反而不必。
  • 给几个:2-3 个足够,覆盖典型情况,最好含一个边界情况(比如"没有待办时输出什么")。
  • 怎么给:每对示例写成"输入→理想输出",格式与你真正想要的一模一样——AI 会连格式细节一起模仿。

改写对照 2:会议纪要待办提取(60 分→90 分)

60 分提示词:

从下面的会议记录里提取待办事项。
会议记录:(粘贴约 800 字转写稿)

病根:输出全看缘分——有时一大段话,有时列清单,有时把"讨论中的假设"也当成待办;责任人和截止时间时有时无。

90 分提示词:

从会议记录中提取待办,输出四列:事项、责任人、截止时间、状态。
规则:只提取明确分派的具体任务;泛泛号召、没定下来的事不提取;任务明确但没说谁负责的,责任人写"待确认";状态只能是:未开始/进行中/已完成。

示例 1 输入:小王下周三前把测试报告发给老李。
输出:| 撰写测试报告并发送 | 小王 | 下周三 | 未开始 |

示例 2 输入:大家下个月看看竞品的方案,回头再聊。
输出:(不提取——只是泛泛号召,不是具体任务)

示例 3 输入:(记录里没有任何任务分工)
输出:(无待办)

示例 4 输入:演示视频下周一客户会前要重新剪一版,没说谁做。
输出:| 重新剪辑演示视频 | 待确认 | 下周一前 | 未开始 |

会议记录:(粘贴原文)
对照维度 60 分版 90 分版
格式 段落/清单随机 四列表格,列名写死
口径 讨论假设混进待办 "明确分派"才提取
缺失值 时有时无 统一写"待确认"

③ 迭代追问:指出差距 → 让 AI 自评 → 再修

核心原则:喂"差在哪",比喂"重写"有效得多。"重写"没有新信息,AI 只是重新掷一次骰子;"差在哪"是给它新的锚点。三步法:

  1. 指出差距:具体到"哪一条、缺什么"——"第二条全是套话、没有数字"远好于"不满意,重来"。字数超了别整体重写,直接追问:"超了约 15 字,压到 120 字内,保留需主管确认的标注。"
  2. 让 AI 自评:把验收标准列给它,让它给自己的输出打分、说扣分点,它常会自己发现漏洞。
  3. 再修定稿:把确认的差距连同补的素材一起喂回,最后合并成一条 90 分提示词存档复用。

改写对照 3:周报总结(完整迭代记录,60 分→90 分)

第 0 轮 · 60 分提示词:

把我这周的工作整理成周报:
1. 写完了登录模块
2. 修了几个 bug
3. 开了三个会

输出毛病:空话连篇("积极推进各项工作")、三条没有轻重,还替你编了下周计划。

第 1 轮 · 指出差距:

重写要求:①删掉所有套话,每条进展必须有可核查的动作或数字;
②按"本周进展/风险/下周计划"三段组织;素材里没有下周计划,如实标"待补充",不许编。

第 2 轮 · 让 AI 自评:

按三个标准给你刚才的周报打分并说明扣分点:进展可核查(有无数字/动作)、无虚构(下周计划是否如实标注)、结构完整(三段齐全)。

AI 自评答:"修了几个 bug"仍不可核查,扣分。——差距找到了。

第 3 轮 · 补素材再修:

"修了几个 bug"改为:修复登录页验证码不刷新、订单列表分页错乱 2 个 bug。其余不变,输出最终版。

90 分定稿提示词(合并 0-3 轮成果,可存入预设库长期复用):

你是项目组周报整理助手。只基于我给的素材汇总,不得虚构;
风险、下周计划若素材没有,该段只写一行"待补充",不要推测、不要凑条数。
输出三段:本周进展/风险/下周计划,每段不超过 3 条,
每条以动词开头、含可核查的动作或数字。
素材:
1. 完成登录模块开发(含手机号验证码登录)
2. 修复 2 个 bug:登录页验证码不刷新、订单列表分页错乱
3. 参加需求评审会、项目周例会、跨部门排期会
对照维度 60 分版 90 分版
空话 "积极推进"满天飞 每条可核查
虚构 下周计划 AI 自己编 缺失标"待补充"
结构 一段流水账 三段固定
复用 每周从零开始 存为 P1,每周只换素材

④ 输出格式控制:表格 / JSON / 字数 / 结构模板

前三招解决"内容对",这一招解决"样子对"——让输出能直接粘进你的文档、表格或脚本:

  • 表格:列名自己写死,别让 AI 起名("输出四列:事项、责任人、截止时间、状态")。
  • 字数:给上限而不是"简短点";长输出加一句"先结论后细节"。
  • 结构模板:把段落顺序直接写出来("第一段共情,第二段方案,第三段下一步"),AI 会严格照排。
  • JSON(脚本和程序能直接读的数据格式):要喂给脚本或自动化流程时,写明字段名和取值范围:
把上面的待办输出为 JSON 数组,字段:task(字符串)、owner(字符串)、deadline(字符串)、
status(字符串,只能是"未开始/进行中/已完成")。只输出 JSON,不要其他文字。

网页对话对纯 JSON 不一定严格,关键的自动化场景建议走开放平台(各家面向开发者的 API 平台)的结构化输出模式。格式要求写得越"语法化"(字段、枚举、顺序),AI 自由发挥的空间越小——这也是为后续自动化铺路。

收尾:用自评清单打分定稿

每条定稿提示词过一遍清单(第 1 条对应 ① 的避坑,第 4 条对应 ② 的给样例):

# 检查项 ✓/✗ ✗ 时的补救
1 角色立住:身份具体有职责清单,不靠形容词 回 ①,写职责不写头衔
2 任务单一:这条提示词只干一件事 拆成多条分着发
3 约束可检验:字数/格式/禁编造能对着输出打勾 把"好一点"换成可数指标
4 需要稳定格式时,给了 2-3 个"输入→输出"示例 回 ②,补样板
5 素材喂齐:背景、原文、数据都在提示词里 补素材,别让 AI 猜;敏感信息先脱敏(见 A5)
6 边界画了:不编造/不改事实/超范围要标注 加一句"缺失标'待补充'"
7 输出结构与用途对齐:字段分段能直接拿去用 回 ④,把格式写死
8 不挑模型:换一家助手核心要求仍然生效 粘到另一家跑一次,看结构/约束是否仍被执行;仍失效就删掉依赖某家习惯的措辞

打分规则:✓ ≥6 项,且第 3、6 项必须 ✓;任一 ✗ 必须回炉。

原理小结:为什么四件套能让输出变稳

大模型每写一个字,都是从一张"概率分布"里挑词——你给的上下文(这次对话里 AI 能看到的全部内容,有长度上限),决定这张分布往哪儿偏。人话版:

  • 角色预设是收窄分布:让它只像"这个身份"那样说话,而不是谁都像、谁都不像。
  • 少样本示例是给分布发样板:照猫画虎,总比凭空画稳。
  • 迭代追问是带着新信息再生成一轮:把"差在哪"的反馈喂回去,比干点"重新生成"命中率高。
  • 格式控制是给输出加语法约束:把自由发挥的空间一格一格挤掉。

四招的共同点:都在降低输出方差(=输出的波动幅度)——从"时好时坏"到"稳定好用",靠的是调分布,不是碰运气。

常见问题 / 排错

Q:示例给得越多越稳吗? A:不。3 个高质量胜过 10 个平庸;示例之间口径必须一致——互相矛盾的示例比没有示例更糟;太多还会占满上下文、稀释重点。

Q:角色写"资深、专业、顶级专家"还不够强吗? A:形容词锚不住行为。AI 不知道"资深"具体指什么,但知道"退款承诺须标注'需主管确认'"具体指什么。写职责清单,别堆头衔。

Q:不满意就点"重新生成"或说"重写",为什么没用? A:没有信息增量,等于重新掷骰子。喂"差在哪":第几条太空、缺数字、语气太冲——差距越具体,下一版越准。

Q:在 Kimi 调好的提示词,到通义千问就变味? A:检查是否用了某家特有的指令习惯。好提示词应自包含——要求全写在提示词里,不指望某家的隐藏默认行为;别把它调成只对一个模型好使。

Q:四件套每次都要全上吗? A:不用。写文案靠角色+风格;提字段靠少样本+格式;一次性简单任务,A3 基本式就够。按需组合。

小结 + 延伸

一句话总结:A3 三要素解决"能干活",本篇四件套解决"干得稳"——先设角色,再给样板,不行就追问差距,最后把格式钉死。

进阶去哪儿:

  • 预设库入知识库:把 P1-P7 作为普通笔记存入即可,统一管理与更新(知识库怎么搭见 F2(个人知识库))。
  • 落地实例:**B29(邮件回复)**的回复预设、**B30(腾讯文档/飞书 AI)**的 AI 字段提示词,就是本文方法的现成落地。
  • 通往自动化:④ 里的 JSON 格式控制是给脚本和 RPA(机器人流程自动化软件)留的接口——现在定好字段,将来机器直接吃。
  • 回看基础:忘了"角色+任务+约束",回 A3《提示词工程入门(办公场景版)》

CTA

四件套练熟后,把你的预设库在评论区晒一条,我们一起打磨。下一篇 A9 · 手机上的 AI 办公:通勤路上、外勤现场,怎么用手机把 AI 办公跑起来。


本文为《AI 办公实战:从小白到达人》系列 A8(A 系列方法论 · 提示词 / L2)。作者:贺迅。状态:草稿。