模型为什么不听话
搞懂这一件事,后面十三天的所有技巧才有地方落脚。
概念课:它不是在执行,它是在续写
你有没有遇到过这种事——同一条提示词,今天给你一个整齐的 Markdown 列表,明天给你三段散文。你一个字都没改。
要解释这件事,得先拆掉一个根深蒂固的直觉:你以为你在下命令。
其实模型在做一件朴素得多的事——猜下一个字。
它更像输入法,不像下属
你在手机上打「今天天气」,输入法蹦出「真好」。它不懂天气,也不关心窗外下没下雨。它只知道在中文里,这四个字后面最常跟着什么。
大模型是同一件事的极致版本。它读完你输入的所有内容,算出「接下来最可能是什么」,吐一个字;再把这个字接上去,继续算下一个。一路滚到结束。
所以你写的东西,在它眼里不是「指令」,是上文。它在给你的上文,找一段最像样的下文。
这个转换一旦完成,很多怪事立刻通了。
你没写的部分,它拿平均值填
你写「帮我介绍一下 Promise」。没说给谁看,没说多长,没说什么口吻。
结果你拿到一段像 MDN 摘要的东西。四平八稳,正确,但你一个字都用不上。
它不是敷衍。它是把互联网上所有「介绍 Promise 的文字」求了个平均,然后交给你。你没规定的每一项,它都用最常见的那个值填上了。
这就像你走进理发店说「随便剪剪」。你不会得到最适合你的发型,你会得到这家店剪得最多的那个发型。
顺着这个逻辑,还有一个更有用的推论:把话说重不管用。
「请务必」「非常重要」「一定要注意」——这些词几乎不改变结果。因为它们没有告诉模型任何新的约束,只是让上文长了几个字。真正管用的是具体:把「写得专业一点」换成「假设读者是 3 年经验的前端,已经会用 Promise 但没读过规范」。前者是形容词,模型得猜;后者是坐标,模型直接定位。
四个格子,漏一个就出事
知道原理之后,检查一条提示词就有了固定的动作——看这四个格子填没填:
| 格子 | 它回答什么 | 漏了会怎样 |
|---|---|---|
| 做什么 | 动作是什么 | 它开始跟你闲聊,或者反问你想干嘛 |
| 给谁看、什么前提 | 受众、场景、约束 | 拿到平均答案。正确,但没用 |
| 对什么做 | 处理对象在哪 | 它自己编一个例子来处理 |
| 结果长什么样 | 交付物的形状 | 格式天天变,接不进任何流程 |
开头那个「今天列表、明天散文」的问题,答案就在最后一行。
你说清了任务,没说清交付物。 Markdown 列表和三段散文,对模型来说都是「介绍 Promise」的合理形态。它每次挑一个,你觉得它不稳定——可你从头到尾就没规定过。它没变,是你没说。
例子比形容词强十倍
还有一件事值得单独拎出来:什么时候该给例子。
你说「写得口语一点」,模型得猜口语到什么程度——是「咱们来看看」,还是「这玩意儿贼坑」?它猜不准,就取个中间值,于是你又拿到一段不咸不淡的东西。
但你要是把自己写过的两段丢进去,情况完全不同。它不用猜了,它有参照物。
判断该不该给例子,只用问一句:你是在示范「长什么样」,还是在示范「怎么想」?
- 示范长什么样——格式、语气、结构。给例子,效果立竿见影。
- 示范怎么想——推理、判断、创意。给标准,别给例子。例子会把它锁死在你给的那条思路上,本该发散的地方全塌成一个样。
照着这个模板改一遍
code# 做什么 —— 一句话,动词开头
把下面这段技术说明改写成面向 3 年经验前端的讲解。
# 给谁看、什么前提 —— 越具体,越能挤走平均值
读者会用 Promise,但没读过规范。
发在公众号「前端达人」,读者耐心大约 800 字,超了就划走。
# 对什么做 —— 用标签把处理对象圈起来
<原文>
(粘贴在这里)
</原文>
# 结果长什么样 —— 能量化的都量化
输出 Markdown,结构固定:
1. 一个真实开发场景的开头,不超过 120 字,不要编人物对话
2. 三段讲解,每段带小标题
3. 一段代码,标识符英文、注释中文,域名用 qianduandaren.com
4. 一句收尾,给下一步动作,不要总结全文
总字数 700–900。不要出现「相信很多同学」「众所周知」。四块之间用注释或标签隔开,不是为了好看。是为了下次你只换第三块,前两块原样不动——这是一条提示词能被反复用的最低门槛。
什么时候这套不灵
- 你自己都没想清楚的时候。 四个格子填不出来,说明问题出在你这边,不在提示词。这时候硬套模板只会写出一条又长又空的东西。先把「我到底要什么」想明白,再动手。
- 别再写「让我们一步步思考」。 这句话在几年前很灵,现在的推理型模型自己就会展开思路,你再催一遍反而打乱它的节奏。真要控制它怎么想,指定维度:「先列出所有会影响结果的因素,再逐个评估」——这才是有效的。
- 需要多样性的场合,例子是毒药。 让它起 10 个标题,你给了 3 个示例,剩下 7 个会长得跟示例一模一样。这种时候给判断标准,不给样本。
今晚练什么
拿你手上最常用的那条提示词,按四个格子过一遍,找出漏掉的那一格。
练习课:给你的老提示词做一次体检
今晚做什么
从你现在的技能包里,挑一条用得最多、但时不时翻车的提示词。
别挑你最满意的那条——它没有信息量。就挑那条让你偶尔皱眉、又懒得改的。
把它按四个格子拆开,你多半会发现:翻车的地方,恰好对准某个空着的格子。补上,然后用一模一样的输入,新旧各跑一次。
今晚的目的不是修好一条提示词。是让你养成一个条件反射——以后看到任何一条提示词,脑子里自动浮出那四个格子。后面十三天全建在这个反射上。
照着填
markdown## 原来那条
(原样粘贴,别顺手美化)
## 四格体检
| 格子 | 原文里对应哪一句 | 判定 |
|------------------|------------------|--------------------|
| 做什么 | | 清楚 / 含糊 / 没有 |
| 给谁看、什么前提 | | 清楚 / 含糊 / 没有 |
| 对什么做 | | 清楚 / 含糊 / 没有 |
| 结果长什么样 | | 清楚 / 含糊 / 没有 |
## 诊断
最弱的一格是:____
我猜它导致的具体毛病是:____
(要写「每次标题层级都不一样」这种,不要写「效果不好」)
## 补完的新版
(完整贴出来)
## 新旧对照
| | 旧版 | 新版 |
|----------------|------|------|
| 结构对不对 | | |
| 哪里还得手改 | | |
| 字数、格式稳吗 | | |
## 结论
新版真的更好吗?好在哪一句?还是只是更长了?做完怎么算过关
- 四格全填完,且至少有一格判为「含糊」或「没有」。四格全「清楚」说明你挑的太简单了,换一条。
- 新旧两版用完全相同的输入各跑一次,两份原始输出都留着,不许事后修剪。
- 「诊断」写的是具体毛病,不是「效果不好」。
三个问题问自己
- 我补的那一格,是真的在挤走平均值,还是只是把话说得更客气了?
- 把新加的那段删掉,输出会退回旧版的样子吗?如果不会,说明我改的不是关键。
- 这条新版能不能原样交给另一个人用?他要改动的地方,就是我还没说清楚的地方。
存哪儿
命名 01-四格模板.md,连同新旧对照一起存。这是你提示词库的第一条。
如果这篇对你有帮助,欢迎关注公众号「前端达人」,每周更新实用前端干货。

