英伟达要哭了,DeepSeek豪掷25.6亿美元采购16万颗华为芯片,比肩甚至超越谷歌和马斯克公开的最大型AI集群
一场价值180亿人民币的“国产替代”宣言
科技圈炸了。
9月4日,彭博社援引知情人士消息曝出一个重磅炸弹:DeepSeek计划在内蒙古乌兰察布建设一座大型智算中心,部署至少16万颗华为下一代昇腾950DT芯片,订单总额高达约25.6亿美元(约合人民币180亿元以上)。
消息一出,整个AI圈都在问同一个问题:16万颗芯片,这到底是什么水平?

全球顶级AI集群,也不过如此
横向对比一下就知道这个数字有多震撼。
马斯克旗下xAI公司在田纳西州孟菲斯市打造的Colossus超级智算集群,2024年底投产时首期部署了10万颗英伟达H100芯片,被称为“全球最大的单体全液冷数据中心”。即便是后来扩容,也不过是15万块H100加上5万块H200。
谷歌的第八代TPU 8t通过其Virgo网络架构,单架构可实现超13.4万颗芯片组网。
亚马逊与英伟达合作的“Project Ceiba”超级计算机,搭载的是1.6万颗英伟达H200超级芯片。
DeepSeek的16万颗,在单一集群的芯片数量上已经比肩甚至超越了这些西方科技巨头公开的最大型AI集群。
当然,也有更大的规划——英国AI公司Nscale与微软签署协议,计划在欧美数据中心部署约20万颗英伟达GB300芯片。但那是规划,而DeepSeek的16万颗是实打实的订单。
为什么选华为,不选英伟达?
答案其实很残酷:不是不想选,是没得选。
美国对华芯片出口管制持续加码,英伟达能卖给中国市场的只有“阉割版”H20。这款特供芯片的算力被砍到了H100的15%甚至更低——花着接近旗舰的价格,买到的却是“残血版”性能。
而华为昇腾950DT呢?搭载自研HiZQ 2.0高带宽内存,容量达144GB,内存访问带宽4TB/s,芯片互联带宽2TB/s。它更侧重推理Decode阶段和训练场景,通过华为自研的“灵衢”互联技术,Atlas 950超节点最多可支持8192张昇腾卡协同工作。
DeepSeek创始人梁文锋今年7月的一段话很直白:英伟达GB300能完成的任务,华为超节点同样可以完成,延迟等方面没有明显差别。他甚至直言,四张华为的芯片顶一张英伟达的芯片,技术上落后约两年。
但问题是——英伟达的顶级芯片,华为买不到。而华为的芯片,随时都能供货。
一场“推理”的豪赌
值得注意的是,DeepSeek这批芯片主要用于模型推理,而非训练。
这背后是一个清晰的战略判断:训练可以依赖英伟达存量卡,但推理是未来增长最快的战场。
DeepSeek此前曾表示,受限于高端算力,其API服务吞吐十分有限。而昇腾950超节点批量上市后,这个问题有望得到解决。
更深层的信号在于:中国头部AI公司正在构建“训练靠英伟达、推理转国产”的双轨算力体系。这不再是个别企业的试水,而是整个行业的趋势性转向。
除了DeepSeek,智谱已在内蒙古建成采用国产芯片的吉瓦级数据中心,美团的大模型在五万张国产芯片上完成了全流程训练。字节跳动也在洽谈内蒙古的新算力项目。
当所有头部玩家都在做同一件事,趋势就已经不可逆转。
挑战依然存在
当然,事情没那么简单。
首先是产能。华为昇腾950DT要到2026年第四季度才正式推出,目前年产量仅几十万颗。完成这16万颗的订单,可能需要一年以上甚至18个月。
其次是生态。英伟达花二十年搭建的CUDA软件生态,全球几百万开发者都在用。这个生态惯性巨大,不是华为短期能撼动的。
最后是性能差距。梁文锋自己也承认,华为落后英伟达约两年。
但趋势已经明朗
英伟达似乎也开始意识到这一点。有业内人士表示,英伟达如今已将中国市场视为“失去的市场”。
这句话可能有点夸张,但方向是对的。
DeepSeek这25.6亿美元的大单,不只是一次采购,更是一份用真金白银投下的“国产替代”信任票。
当一家以“极致性价比”著称的AI公司,愿意花180亿等一年以上来买华为的芯片——这本身就是最有力的宣言。
英伟达或许还没哭,但已经笑不出来了。
- 暂时没有评论,来说点什么吧





