用 Am I replacable 测完之后发现我这脑子确实被 AI
说白了,这就是个给人类设计的“压力测试”工具。它不是在比谁的代码写得快,而是在测你作为人的认知能力是否在退化。比如它会通过特定的任务去探测你对长文本的把控力,或者在复杂逻辑链条中的记忆维持能力。如果你在测试里被 AI 轻松碾压,那说明你可能已经习惯于让 AI 替你思考,而不是把 AI 当成增强工具。
这个项目的 MVP 版本目前主要集中在“上下文窗口”这个维度上。其实这个切入点很有意思,因为 AI 的 context window 越来越大(动辄 128k 甚至 1M),而人类的短期记忆容量极其有限。当我们将所有依赖都交给模型时,我们处理复杂问题的“内存”其实是在下降的。作者在设计这个 harness 时,想通过这种量化的对比,提醒用户通过刻意练习去提高自己的 prompt 能力,而不是单纯地做个指令传递员。
如果你想尝试,基本流程是这样的:
一、启动测试
进入界面后,它会给你推送一系列具有干扰项的任务。这些任务要求你在阅读一段信息后,在不借助任何 AI 辅助的情况下,回答关于细节的逻辑推演问题。
二、能力对标
- 信息检索能力: 测你对文中具体数字、名称的敏感度,看是否在快速阅读时丢失了关键锚点。
- 逻辑推演能力: 给定 A → B → C 的链路,看你能否在没有模型辅助的情况下快速还原逻辑链。
- 抗干扰能力: 在大量噪声信息中提取有效结论的速度。
三、结果分析
最后它会给出一个对比结论。如果你在某些维度上得分极低,那就说明你在这个认知环节上已经完全依赖 AI 了。
我觉得这个工具最大的价值在于它提供了一个“镜像”。很多时候我们觉得自己掌控了 AI,但实际上是 AI 在定义我们的思考方式。比如现在写文档,很多人是先让 AI 出大纲,再让 AI 填内容,最后自己改几个错别字。在这个过程中,你其实没有进行任何真正的结构化思考,你的大脑处于休眠状态。
不过这个工具目前还是非常早期的 MVP 阶段,功能比较单一,只覆盖了认知窗口这一个维度。其实还有很多可以深挖的地方,比如注意力的持久度、长短期记忆的转换效率,甚至是对多模态信息的处理能力。如果以后能把这些维度都加进去,那它就真的成了一个衡量“人类竞争力”的量表。
对我来说,最有用的一点是它提醒我:想成为一个顶级的高级用户(Pro Prompter),前提是你得拥有比 AI 更强的批判性思维和逻辑掌控力。如果你自己都分不清正确答案和一本正经的胡说八道,那你永远只能被 AI 牵着走。