Ollama Cloud 额度消耗的坑
谁能告诉我 Ollama Cloud 的额度是怎么计算的?我本以为 DeepSeek V4 Pro 这种模型比较便宜,结果上手试了试,5 小时的额度瞬间被刷光了,这反差也太大了。
下一篇
分享一个AI技能进阶的路径图 →
按照常理,模型的“智能程度”或者参数规模应该跟额度消耗成正比,但这次实测下来完全不是那么回事。为了搞清楚原因,我跑了一遍所有模型的 benchmark,结果发现额度消耗和模型能力之间根本没有直接的相关性。
如果你也好奇自己的额度是怎么没的,或者想看看不同模型的实际消耗情况,可以参考这个具体的测试结果:
https://blog.micr.dev/blog/i-made-my-first-benchmark对于想自己验证或者复现这个测试的人,可以直接去拉这个 repo 跑一下:
https://github.com/Microck/ollama-quota-bench这次踩坑最大的感触就是,千万别凭直觉觉得某个模型“便宜”,在没看到具体计费逻辑前,建议大家谨慎使用高频调用,否则额度跑光得比想象中快得多。