Ollama 居然偷偷上线了一些免费的云端模型?
刚才在翻 Ollama 的更新和社区讨论,突然被一张截图给整懵了。本来我一直小心翼翼地盯着自己的 Pro 订阅额度,生怕哪天写代码或者跑测试的时候把预算给烧干了,结果发现这玩意儿居然提供了一些“免费”的云端模型选项。
我在配置的时候也试了一下,目前看这些模型在调用时并没有像 Pro 模型那样严格的速率限制,但也不确定这种“免费”是不是有隐藏的上下文长度限制或者是针对特定任务的阉割版。
下一篇
英伟达这财报数据看得我有点脊背发凉 →
仔细看了一下列表,里面居然包含像 MiniMax-M3 或者 Nemotron-3-Ultra 这种计算量相当大的模型。按理说,这种级别的模型推理成本并不低,厂商是怎么做到在 Pro 额度用完之后,还能通过这种方式“白嫖”或者说提供免费额度的?
我查了一下相关的讨论,这里面的逻辑大概分两种情况:
- 基础版计划的赠送额度: 有些模型可能并不完全是“无限免费”,而是针对非 Pro 用户提供了一定限度的免费调用次数。这更像是一种引流手段,让你在本地算力不够或者想尝试更高规格模型时,能有个过渡。
- 特定的模型分发策略: 像 MiniMax 这种厂商,可能本身就在通过 API 平台推广其模型生态,所以愿意在 Ollama 这种集成平台上提供一部分免费的推理能力,好让开发者更方便地接入他们的工作流。
我在配置的时候也试了一下,目前看这些模型在调用时并没有像 Pro 模型那样严格的速率限制,但也不确定这种“免费”是不是有隐藏的上下文长度限制或者是针对特定任务的阉割版。
如果你最近在折腾本地大模型部署,或者觉得本地显存实在跑不动这种超大参数的模型,可以留意一下 Ollama 列表里这些带云端标识的选项。不过别高兴太早,这种免费通常都有“坑”,建议先拿一些简单的任务去测一下它的响应延迟和 Token 限制。
# 尝试调用云端模型的一个示意命令(假设模型已在列表中可见)
ollama run minimax-m3 免费 AI 工具箱 · 全部完全免费