AI预测已经做到超过人类顶尖预测者,这事在圈内传了快一年
这家公司的路子跟市面上所有"AI算命"产品都不一样。创始团队来自Metaculus,就是那个常年让一堆理性主义者预测AGI什么时候来的平台。他们在2023年8月就开始了,在Tetlock那套"什么都可预测"的框架下,算是AI预测这个方向的原创玩家。
下一篇
弱模型调试法:模型越笨,照出的 Bug 越多 →
先看战绩:目前他们在Metaculus夏季竞赛里194个参赛者中排第一,在混合人机锦标赛里压过了排名第二和第三的人类预测者。这个含金量不低,因为Metaculus那帮人是真的把"校准度"和"布莱尔分数"当命根子。
他们跟预测市场是两码事。FutureSearch不做金融,而是聚焦科学进展、地缘政治这类"人类命运级"问题。团队之前在Metaculus把人类预测推到了极限,这次干脆合作写了AI 2027时间线预测,预言超人类编码和研究能力在2032年前后出现——比同行保守,比怀疑论者激进。
公测期跑了超过一万次正经预测,什么话题都有,还支持"如果我做X,能不能达成Y"这类决策预测。免费档直接给了几个最高成本预测器,打算让所有人亲自验证质量,毕竟市面上一堆AI预测的吹牛文章,眼见为实比啥都强。
我的看法:比准确率更重要的是他们公开了评测路径[1],预测市场的表现也有据可查[2],AI 2027的研究管线能看出推理过程[3]。当然,[4]那篇反驳"超人类AI预测"的文章也值得看,别光听一家说。
AI预测的斜率确实在往上走,但拐点在哪、会不会撞墙,谁也说不准。至少这次有人把验证工具摆到桌面上了。
[1] https://www.metaculus.com/tournament/summer-futureeval-2026/
[2] https://www.astralcodexten.com/p/the-ai-superforecasters-are-here
[3] https://ai-2027.com/research/timelines-forecast
[4] https://www.lesswrong.com/posts/uGkRcHqatmPkvpGLq