DeepSeek据报正筹备在内蒙古乌兰察布部署一套大规模华为AI算力系统:至少16万颗下一代昇腾950DT加速器,用于一座规划算力约为1GW的数据中心运行模型。DeepSeek和华为均未公开确认这一订单或交付时间表,因此现阶段应将其视为报道中的部署意向,而非已建成并投入运行的集群。
4
5
这16万颗芯片,主要用来“推理”
知情人士称,DeepSeek计划将昇腾950DT主要用于推理,即响应用户请求、生成模型输出,而不是承担其主要模型训练任务。若按至少16万颗的规模完成部署,它可能跻身已知规模最大的华为AI加速器集群之列。
5
8
推理与训练的区别很关键。大规模推理集群能够支撑更广泛的模型服务,并可能在规模化运营中改善成本表现;但这本身并不意味着华为硬件已经覆盖DeepSeek的全部算力栈。有关该项目的报道显示,DeepSeek仍在使用英伟达硬件进行训练。
8
为什么完整交付可能超过一年
关键约束不只是资金或数据中心建设速度,更是供应能力。报道显示,DeepSeek希望获得的华为高端芯片数量超过华为目前可提供的水平;高端存储器等零部件短缺,也可能令昇腾950DT今年的产量受限于数十万颗的较低区间。相较于可用供给,16万颗的需求规模相当庞大。
8
供应压力主要来自三方面:
- **高端存储器等关键部件紧缺:**先进AI加速器依赖高带宽存储器及其他专用组件,任何一个环节受限,都可能压缩最终成品芯片的出货量。
8
- **华为的产能并非无限:**该项目的安装进度据报取决于华为的制造能力。向单一客户增加分配,并不会立刻提高整体产出。
5
- **大型客户同步争抢供货:**在DeepSeek发布V4后,昇腾950芯片需求上升。路透社报道,字节跳动、腾讯和阿里巴巴等中国大型互联网企业都在寻求下单,这意味着DeepSeek将与云服务和互联网公司竞争同一批供给。
即使获得更多支持或更优先的供货分配,也只能改善DeepSeek在排产队列中的位置,无法立即消除零部件和制造环节的瓶颈。最终要看的不是目标数字,而是有多少加速器真正交付、完成集成并保持稳定运行。
这与中国建设本土AI技术栈有何关系
乌兰察布项目若推进,契合中国降低对美国技术依赖、构建本土AI技术栈的方向。DeepSeek的V4预览版已适配华为先进昇腾芯片;华为则表示,V4可在其基于昇腾950的超节点集群上获得支持,其芯片也参与了V4-Flash的部分训练。
2
3
这种软件适配的战略意义不小。AI硬件能否被大规模采用,不只取决于加速器是否供应充足,还取决于模型、框架、开发工具和部署流程能否协同运作。头部模型对昇腾平台的优化,可为云服务商、企业和开发者提供投入该平台的理由,从而带动芯片与周边软件生态的需求。
不过,不能因此将这一计划视为已实现对英伟达的完全替代。该项目重点是推理,而DeepSeek的训练工作负载据报仍依赖英伟达系统。
8
规模既是机会,也是风险集中点
16万颗芯片组成的集群,将是中国AI开发者瞄准超大规模基础设施的一次高调尝试。它有望让DeepSeek获得可观的自有模型运行能力,而不必完全依赖外部云算力。
但规模越大,对供应链的压力也越集中。较小项目可以通过分批生产和逐步调配来完成;而16万颗的目标,需要在供给受限的产品线中争取相当大的份额,同时面对整个中国市场对同类硬件的采购需求。
8
接下来应关注哪些节点
“16万颗”体现的是雄心,而不是完成状态。更有意义的观察指标包括:订单是否得到确认、昇腾950DT的交付速度、可实际使用的装机容量,以及该系统运行DeepSeek模型时的成本和可靠性。
若该集群以接近报道规模投入运行,将是华为昇腾生态和中国本土AI基础设施建设的重要一步;若交付延后,则会凸显一个现实差距:设计本土AI技术栈是一回事,要在大规模部署中制造并供应每一种稀缺组件,则是另一回事。
5
8