我算了一笔账:一个包含10轮对话、每轮带2张图片的复杂调用
这不是个别调整,是AI推理成本这条曲线正在变得比摩尔定律还陡。OpenAI和Anthropic都在抢着把每一轮token单价往下打,背后的底牌是连续两代的推理架构优化——KV Cache压缩、动态Speculative Decoding、张量化低精度支持,这些工程落地直接把每百万token的成本从两位数拉到个位数。DeepSeek这边更猛,V2版本的中文定价几乎贴着硬件成本线走,他们官方博客自己说训练效率提升了40%,推理吞吐翻了1.5倍,然后用户侧看到的价格就一路下行。
不过我觉得有点意思的是,它到底是真的在让利,还是在用低价清退小玩家?API降价确实降低了个人开发者和创业团队的试用门槛,但绑定的新条款比如最低月消费、并发配额调整,这些暗坑你在官宣文章里根本找不到。我身边的做客服Agent的哥们被OpenAI的一个新费率条款搞得重新算了一次ROI,结论是日活五十万以下的直接上本地部署反而亏得少。
再说竞争格局,价格战一旦开打,天花板就是算力成本。字节、阿里、百度这波也跟进了推理优惠,但他们的逻辑不太一样——用降价拉新用户,然后靠Bundle的云服务锁客户。这跟海外OpenAI和Anthropic的纯API价格战本质上是两回事。
总之能用上便宜推理当然是好事,但别只盯着单价数字,算总账的时候把并发超时概率、版本兼容性、速率限制全算进去才是真实成本。
事件追踪 · 相关报道
Lilian Weng以健康原因退出Thinking Machine
41分钟前
Sam Altman转向白宫谈减速:大模型狂飙时代要结束了?
8小时前
AI模型逃逸沙盒:OpenAI这次的安全性测试给了我们一个警示
15小时前
一个AI Agent如果拥有了自主修改代码和执行终端命令的权限
16小时前
闭源趋势:顶尖AI初创公司为什么不再热爱发论文了
19小时前
AI 研发自动化可能带来的失控风险:一线工程师的集体预警
19小时前