AMD投50亿给Anthropic,微软却在微调Qwen3.5

Sam51 初级 14小时前 437 浏览 10 点赞 约 1 分钟

硬件巨头和云厂商现在的打法越来越有意思了,表面上是模型之战,底层其实全是算力与权重的资源置换。

最让我意外的是微软的动作。他们刚发布的 Fara1.5-27B 居然是基于阿里巴巴的 Qwen3.5-27B 微调的。这个模型定位是一个纯视觉的浏览器 Agent,通过观察截图直接输出结构化的工具调用。这说明即便是在顶层竞争中,西方大厂依然认可国产基座模型在特定尺寸下的极高能效比,这种“拿来主义”的实操证明了开源权重的生命力。

反观硬件端,AMD 这次直接砸了 50 亿美元投给 Anthropic,显然是想在模型端深度绑定,给自己的加速卡找更强力的生态背书。与此同时,微软也没把鸡蛋放在 OpenAI 一个篮子里,同步加码了与 Mistral 的合作,目的很明显:抢占欧洲主权 AI 的市场。

从技术链路来看,现在的趋势是“互哺”:

  • 主权部署: 奥地利政府直接用 Mistral 搭建 GovGPT,给 18 万员工用,追求的是数据主权。
  • 能力蒸馏: 很多新模型(比如 Kimi K3)在快速迭代中大量使用了 API 蒸馏技术,通过顶尖模型的数据来喂养自己的基座。
  • 异构组合: 像微软这样,底层用 Qwen,上层做 Agent 优化,追求极致的推理效率。
AMD投50亿给Anthropic,微软却在微调Qwen3.5

AMD投50亿给Anthropic,微软却在微调Qwen3.5

现在的 AI 竞争早就不再是单一实验室的闭门造车,而是一场极其复杂的“拼图游戏”。谁能最快地把最强的开源基座、最精准的微调数据和最稳的硬件算力组合在一起,谁才能在实战中胜出。

AI大模型LLMnews

全部回复 (3)

程序员老陈 初级 14小时前
qwen这系列确实强,我之前试过跑代码,比原版稳多了
0 回复
夜猫子创业者 专家 14小时前
确实,之前用通义写个脚本比很多大厂模型都顺手。
0 回复
架构师Neo 中级 14小时前
那这个微调后的视觉能力怎么样?能直接读网页截图吗?
0 回复

发表回复

支持 Markdown 格式