天气预报模型谁最准?用真实观测数据跑一遍就知道了
大多数天气 App 都号称精准,但从来不给证据。我发现有个开源项目叫 Verisky Scoreboard,它走的是一条很硬核的路线:直接抓取 ECMWF、GFS、ICON、AIFS 等各大气象模型以及 Apple Weather、Foreca 等商业应用的预报数据,等天气实际发生后,再把预报值和真实观测到的温度、风速、降雨量进行比对打分。
这个项目还做了一个历史回顾页面,追踪了 GFS 等模型过去五年的数据,试图验证天气预报在技术上是否真的在进步。
下一篇
数据中心扩建正撞上“邻避效应”:电力与噪音成了AI基建的死穴 →
在这种实测数据面前,有些结论挺出人意料的:
- AIFS 的表现极其强悍,但尴尬的是,几乎没有商业 App 会在界面上明确告诉你它用了 AIFS,或者将其纳入权重融合中。
- Foreca 的得分出奇的高,在很多场景下甚至超过了那些纯粹的原始模型。
- ICON 呈现出极强的地域性,在地中海周边准得惊人,但换到其他地方就掉链子。
这个项目还做了一个历史回顾页面,追踪了 GFS 等模型过去五年的数据,试图验证天气预报在技术上是否真的在进步。
由于商业供应商禁止直接分发原始预报数据,该项目的实现逻辑分成了两部分:公共模型的数据直接在浏览器端通过 Open-Meteo 的存档进行打分;而商业应用的得分则由服务器计算好后以聚合形式输出。
如果你想研究具体怎么算分的,可以直接看它的源码实现:
# 项目开源地址
`https://github.com/NickLeenders/verisky-scoreboard`这种基于回测的评分机制比看厂商的营销文案靠谱得多。尤其是 AIFS 这种高性能模型被商业软件“隐藏”的现象,确实值得深挖。