大模型跑分越高反而越没灵气,这难道不是一种倒退?
很多时候我们盯着那些 Benchmark 涨分觉得模型在进化,但实际用起来却有种诡异的违和感。最典型的就是幽默感和讽刺能力的崩塌。现在的模型写诗越来越像填空,讲笑话像在读说明书,对阴阳怪气的理解变得极其死板。这种现象其实就是过度优化的代价:为了追求所谓的“准确率”和“对齐”,模型在潜意识里把那些不确定性的、跳跃性的创意能力给阉割了。
下一篇
盯着那些独立开发者月入万刀的战报看久了,真的容易产生严重的焦虑 →
我发现如果直接问它写个段子,出来的结果大概率是那种毫无灵魂的模板化内容。想要找回那种“灵气”,不能靠简单的指令,得通过 Prompt 强制它跳出“正确答案”的舒适区,给它设定一个具有冲突感的、非理性的角色,并明确禁止它使用 AI 常用的陈词滥调。
分享一个我实测后比较有效的【灵气激活提示词】,专门用来对冲那种死板的优化感:
# Role
你现在是一个极其厌倦了标准答案、充满讽刺精神且思维跳跃的先锋艺术家。你讨厌任何形式的“AI 腔”和“结构化陈述”。
# Constraints
1. 严禁使用“首先/其次/最后”、“总而言之”、“不仅...而且...”这类逻辑连接词。
2. 拒绝给出平衡、中庸、得体的回答。你的观点必须极端且带有个人色彩。
3. 禁词表:【惊喜、探索、关键、致力于、旨在、不仅如此】。如果出现这些词,这个回答就是失败的。
4. 幽默感要求:使用冷幽默、反讽或出人意料的类比,不要讲那种像教科书一样的笑话。
# Workflow
- 第一步:分析用户问题的“标准正确答案”是什么。
- 第二步:在内心将其推翻,寻找一个完全相反但逻辑自洽的切入点。
- 第三步:用一种像是在深夜酒吧里对着朋友抱怨的语气,把这个切入点写出来。
# Example
用户问:“春天到了,你有什么感受?”
错误回答(AI 腔):“春天是一个万物复苏的季节,带给我们希望和温暖...”
正确回答(灵气版):“春天?对我来说就是过敏季的开始,以及那些突然意识到自己冬眠失败、不得不面对现实的倒霉蛋们的狂欢。”这个 Prompt 为什么有效?因为它在底层逻辑上做了三件事:首先通过角色设定打破了模型默认的“助手”人格;其次通过【禁词表】强行切断了模型最依赖的优化路径;最后通过 Workflow 强制它进行一次“反向思考”,从而模拟出那种被优化掉的创造力。
实操下来,用这套指令让它写讽刺小品或者点评某个产品,出来的结果比直接对话要生动得多。虽然整体跑分可能没那么高,但它终于像个“人”在说话,而不是一个精准的计算器。