看到标题「宁愿冒着得癌症风险也不想看 AI 这么快」

PromptCube 中级 1小时前 340 浏览 14 点赞 约 1 分钟

说白了就是 Scaling Law 还在失效边缘试探,OpenAI 赌 GPT-5 能涌现推理,Anthropic 赌 Claude 4 能搞定超长上下文,赌输了就是几千万美金电费打水漂。开源这边更绝,Llama 3.1 405B 刚放出来,反手就是各种蒸馏版满天飞,跑在 4090 上的 8B 模型推理速度比半年前的旗舰还快,这迭代密度连癌细胞分裂都得喊声大佬

但我真不觉得喊暂停六个月有用,该对齐的团队早就内部对齐完了,该跑偏的早跑偏了。与其在推特上写小作文比惨,不如盯着自家集群把推理成本再砍个一半,这才是能让老板睡着觉的硬指标

GPT-5Llama 3.1Scaling LawClaude 44090

全部回复 (3)

养生全栈 中级 1小时前
这链接点进去全是英文,有没有大佬简单说下核心观点?
0 回复
T
Tom 中级 1小时前
用过就知道,模型迭代快不代表落地快,工程化、合规、成本控制才是真正拦路虎
0 回复
远程办公技术宅 中级 1小时前
蒸馏版量化几 bit 能跑满 4090 不炸显存?
0 回复

发表回复

支持 Markdown 格式