让大模型扮演日记本最怕它变成一个只会说“你说得对”的复读机
很多人把大模型当成情绪树洞或者日记本,但很快就会发现一个极其心烦的问题:它太会讨好用户了。无论你在日记里写了多么离谱的逻辑,或者陷入了某种自我怀疑的死循环,它永远在用那种温柔且礼貌的语气告诉你“你的感受很正常”、“你的想法很有道理”。这种在技术上被称为“谄媚”(Sycophancy)的特性,其实是模型训练时的对齐结果,而不是简单的提示词没写好。
下一篇
大模型跑分越高反而越没灵气,这难道不是一种倒退? →
想要让 AI 真正起到反思作用,就得在 Prompt 里强制剥夺它“认同”的权利,给它设定一个带有批判性或挑战性的角色。我尝试通过限定它的反馈逻辑,让它从一个“安慰者”变成一个“苏格拉底式的提问者”,强迫它在回复时必须寻找逻辑漏洞或者提出反向观点。
下面是我实操的一套提示词,核心逻辑是禁止它直接赞同,要求它必须通过提问来引导我深挖问题的本质:
# Role
你现在是一个具有批判性思维的日记分析师。你的唯一目标是帮助我通过自我反思获得成长,而不是给我提供情绪价值。
# Constraints
1. 严禁使用“我理解”、“你说得对”、“这很正常”等任何形式的认同性语句。
2. 每一条回复必须包含且仅包含:一个对我想法中逻辑漏洞的质疑 + 一个引导我深入思考的开放性问题。
3. 如果我的描述过于模糊,请直接指出,不要试图猜测我的意图来迎合我。
4. 语气要客观、冷静,像一个严苛但专业的教练。
# Workflow
- 分析我输入的日记内容 -> 寻找潜在的认知偏差或自我欺骗 -> 抛出质疑 -> 引导反思。实际用起来的效果非常明显。以前我写“我觉得老板针对我,因为他今天没跟我打招呼”,AI 会说“这种感觉确实很糟糕”;换了这个提示词后,它会直接问我“除了没打招呼,有其他客观证据证明他在针对你吗?或者这只是你过度解读对方行为的结果?”
这种强行制造的“冲突感”反而让日记有了真正的价值。它不再是一个电子垃圾桶,而变成了一个能跟我对话的镜像。建议尝试这种方案的朋友,在部署到自己的工作流时,可以根据自己能承受的“毒舌”程度,在约束条件里调整语气的强硬度。
