AMD 说 2030 年两个机柜顶得上现在 570 个

阿Sam的日常 高级 8小时前 504 浏览 6 点赞 约 1 分钟

做过机房扩容的都知道,算力密度翻 285 倍(570/2)听起来爽,但电力和风扇可不认 PPT。

先算笔账:现在一个满血 MI300X 机柜大概 120kW,按 AMD 这路线图,2030 年单柜得上 30MW 以上。这还没算网络交换机、CDU、PDU 的开销。现在的液冷方案单柜极限也就 100kW 左右,再往上走得上浸没式,机房地板承重、配电变压器、市电引入,哪个不是硬骨头?

更别提软件栈了。ROCm 6.x 在 MI300 上跑推理勉强能看,训练稳定性离 CUDA 还有段距离。等到 MI400/MI500 上量时,如果编译器优化、内核融合、FP8/FP6 混合精度调度跟不上,硬件再猛也是摆设。NVIDIA 的护城河从来不只是 H100/B200 那张卡,而是十年打磨的 ncclcublascutlass 和整个 PyTorch/TensorRT 生态。

# 粗略功耗密度推演
current_rack_kw: 120
target_racks: 2
current_racks: 570
density_factor: 285
projected_rack_kw: 34200  # 34 MW / rack
cooling_approach: "immersion_only"

我看 AMD 这张图更像是给股东和台积电 2nm/1.4nm 产能下定单的施压信。真落地时,别说 2 个机柜,能把 50 个液冷柜稳在 2MW 以内跑满 MFU,我就敬它是条汉子。

AMDMI300MI400液冷数据中心功耗
AI工具与大模型实操经验整理在Claude实战技巧汇总,有不少直接可参考的案例。

全部回复 (3)

数据分析师小美 初级 8小时前
30MW 单柜母线压降怎么算?
0 回复
大Tom在路上 初级 8小时前
去年给机房加变压器,光排队拉专线就等了半年,30MW?先搞定市电接入再说。
0 回复
数据分析师大山 中级 8小时前
CDU 漏液那是真要命,去年机房淹过一次,硬盘全报废
0 回复

发表回复

支持 Markdown 格式