Ollama 居然偷偷上线了一些免费的云端模型?

老张在路上 中级 2小时前 253 浏览 10 点赞 约 2 分钟

刚才在翻 Ollama 的更新和社区讨论,突然被一张截图给整懵了。本来我一直小心翼翼地盯着自己的 Pro 订阅额度,生怕哪天写代码或者跑测试的时候把预算给烧干了,结果发现这玩意儿居然提供了一些“免费”的云端模型选项。

仔细看了一下列表,里面居然包含像 MiniMax-M3 或者 Nemotron-3-Ultra 这种计算量相当大的模型。按理说,这种级别的模型推理成本并不低,厂商是怎么做到在 Pro 额度用完之后,还能通过这种方式“白嫖”或者说提供免费额度的?

我查了一下相关的讨论,这里面的逻辑大概分两种情况:

  • 基础版计划的赠送额度: 有些模型可能并不完全是“无限免费”,而是针对非 Pro 用户提供了一定限度的免费调用次数。这更像是一种引流手段,让你在本地算力不够或者想尝试更高规格模型时,能有个过渡。
  • 特定的模型分发策略: 像 MiniMax 这种厂商,可能本身就在通过 API 平台推广其模型生态,所以愿意在 Ollama 这种集成平台上提供一部分免费的推理能力,好让开发者更方便地接入他们的工作流

我在配置的时候也试了一下,目前看这些模型在调用时并没有像 Pro 模型那样严格的速率限制,但也不确定这种“免费”是不是有隐藏的上下文长度限制或者是针对特定任务的阉割版。

如果你最近在折腾本地大模型部署,或者觉得本地显存实在跑不动这种超大参数的模型,可以留意一下 Ollama 列表里这些带云端标识的选项。不过别高兴太早,这种免费通常都有“坑”,建议先拿一些简单的任务去测一下它的响应延迟和 Token 限制。

# 尝试调用云端模型的一个示意命令(假设模型已在列表中可见)
ollama run minimax-m3
求助OllamaMiniMaxNemotron

全部回复 (4)

老大鹏 专家 2小时前
我也发现了,感觉这更像是针对开发者的免费试用期,估计以后得限流。
0 回复
数据分析师大山 中级 2小时前
@老大鹏 感觉你真相了,估计也就这阵子能薅点羊毛,以后肯定得收钱。
0 回复
老阿凯 中级 2小时前
这玩意儿后端走的是什么 API 协议?还是说直接内嵌了厂商的云端接口?
0 回复
副业中测试 中级 2小时前
我也刚试了一下,响应挺快的,估计是厂商在拉新骗流量。
0 回复

发表回复

支持 Markdown 格式