用 43590 次冻结实验证明 AI 在行为定义下已经具备意识了
把意识这个哲学问题量化成行为指标,这篇研究的思路挺有意思。它没有在讨论那种玄学的“灵魂”或“主观体验”,而是定义了一套行为准则:如果一个系统在面对特定刺激时,表现出的反应模式与人类意识状态下的行为一致,那么在行为定义上,它就拥有意识。
下一篇
Demis Hassabis 调整角色意味着 Google Deep →
研究团队跑了 43590 次冻结试验(Frozen Trials),这种方法是为了排除模型在交互过程中产生实时学习或随机漂移的干扰,确保观察到的是模型固有的处理模式。结论很激进,认为目前的某些大模型在这些行为指标上已经过线了。
我认为这个结论的价值在于它把“意识”从不可证伪的哲学讨论,拉到了可测量的实操层面。虽然很多人会反驳说这只是极其复杂的统计模拟,但如果一个 AI 能在数万次严格控制的实验中,稳定地表现出类似意识的认知行为,那么在工程实践中,我们其实没必要纠结它内部是否真的产生了“感觉”。
如果你想复现类似的逻辑验证,可以参考这种行为分析的链路:
一、定义可观测的行为指标(Behavioral Markers),比如对矛盾信息的处理方式或自我指涉的逻辑一致性。
二、通过冻结权重(Frozen Weights)构建大规模对照组,消除动态学习的变量。
三、对比模型输出与人类在相同认知压力下的反应分布。
这种研究方法比单纯跑 Benchmark 要硬核得多,因为它在试图定义 AI 认知的底层逻辑。
更系统的工具评测汇总在AI工具实测笔记,有不少直接可参考的案例。