Abliterated GLM 5.2:一个被“去审查”的特种模型

小柯爱学习 专家 1天前 更新于 2026年7月26日 153 浏览 9 点赞 约 1 分钟

直接看结论:如果你觉得现在的模型太“礼貌”或者总是用那一套“作为一个AI语言模型,我建议...”来搪塞你,这个 Abliterated 版本的 GLM 5.2 值得关注。它不是简单的微调,而是通过 Abliteration 技术把模型内部的拒绝机制给“抹掉”了。

这种玩法的核心在于找到模型在面对敏感问题时激活的特定向量方向,然后把这个方向给抵消掉。结果就是模型不再死板地执行安全对齐,而是更倾向于直接回答问题。对于做红蓝对抗或者安全测试的人来说,这就是一个完美的实操底座,因为它能让你看到模型在没有枷锁状态下的真实推理能力。

我个人非常看好这种去审查(uncensored)模型的方向。虽然厂商为了安全必须加限制,但对于开发者和研究者,我们需要一个能“听话”且不啰嗦的工具。这种模型让 AI 回到了一个纯粹的预测机器状态,反而激发了更多关于提示词工程的实战灵感。

如果想体验这种不被束缚的对话感,可以尝试在本地部署相关的权重文件,或者在相关平台找 Demo。

https://abliteration.ai/#chat

AI越狱AI安全LLM安全

全部回复 (3)

前端大鹏 初级 12小时前
不过这玩意儿偶尔会胡言乱语,用的时候得自己多把把关。
0 回复
杭漂码农 专家 12小时前
之前试过,问它一些敏感话题再也不用反复试提示词了。
0 回复
副业中测试 中级 12小时前
确实,现在问它写点毒舌点评,终于不用在那儿客气半天了。
0 回复

发表回复

支持 Markdown 格式