AMD投50亿给Anthropic,微软却在微调Qwen3.5
硬件巨头和云厂商现在的打法越来越有意思了,表面上是模型之战,底层其实全是算力与权重的资源置换。

下一篇
JS 调试技巧 →
最让我意外的是微软的动作。他们刚发布的 Fara1.5-27B 居然是基于阿里巴巴的 Qwen3.5-27B 微调的。这个模型定位是一个纯视觉的浏览器 Agent,通过观察截图直接输出结构化的工具调用。这说明即便是在顶层竞争中,西方大厂依然认可国产基座模型在特定尺寸下的极高能效比,这种“拿来主义”的实操证明了开源权重的生命力。
反观硬件端,AMD 这次直接砸了 50 亿美元投给 Anthropic,显然是想在模型端深度绑定,给自己的加速卡找更强力的生态背书。与此同时,微软也没把鸡蛋放在 OpenAI 一个篮子里,同步加码了与 Mistral 的合作,目的很明显:抢占欧洲主权 AI 的市场。
从技术链路来看,现在的趋势是“互哺”:
- 主权部署: 奥地利政府直接用 Mistral 搭建 GovGPT,给 18 万员工用,追求的是数据主权。
- 能力蒸馏: 很多新模型(比如 Kimi K3)在快速迭代中大量使用了 API 蒸馏技术,通过顶尖模型的数据来喂养自己的基座。
- 异构组合: 像微软这样,底层用 Qwen,上层做 Agent 优化,追求极致的推理效率。

现在的 AI 竞争早就不再是单一实验室的闭门造车,而是一场极其复杂的“拼图游戏”。谁能最快地把最强的开源基座、最精准的微调数据和最稳的硬件算力组合在一起,谁才能在实战中胜出。
