DeepSeek内蒙古建1吉瓦算力中心,16万颗昇腾芯片专攻推理场景

首页 / AI资讯 / 泛AI领域

0:00
0:00
1x
定时

彭博社9月4日披露的DeepSeek算力计划,在随后的几天里持续发酵,更多部署细节浮出水面。据多家媒体报道,DeepSeek在内蒙古规划建设的新数据中心装机容量达到1吉瓦,将部署至少16万颗华为昇腾950DT芯片,专门用于高并发推理场景。这一规模放在国产AI芯片的部署史上堪称前所未有,也让外界第一次看清了这家头部大模型公司从训练到推理全面转向国产算力栈的决心。

1吉瓦数据中心意味着什么,为什么选在内蒙古

1吉瓦的装机容量放在AI算力圈是什么水平?作为参照,全球最大的单体超算与智算中心大多在数百兆瓦级别,1吉瓦相当于可以同时支撑数十万块AI加速卡满负荷运行的电力规模。对以API服务与C端产品为核心业务的DeepSeek而言,这样的算力体量显然不是为研究预留的,而是为规模化推理设计的生产级基础设施,目标直指海量用户同时发起请求时的高并发推理需求。

选址内蒙古同样是算力布局的典型逻辑。内蒙古拥有丰富的风光资源与低廉的绿电价格,是"东数西算"工程规划的全国一体化算力网络枢纽节点之一,大型数据中心在此建设既能享受电价优势,也符合国家引导算力向西部布局的政策方向。对推理业务而言,用电成本是长期运营的最大变量之一,在电价洼地建设超大推理集群,相当于把未来的运营成本锁死在低位,是一笔着眼于十年的战略投资。数据中心选址还涉及网络时延的考量,内蒙古到京津冀骨干节点的直连线路已经相当成熟,推理请求的往返时延可以控制在可接受范围,并不会因为地理位置偏远而牺牲用户体验,配套的风光电站与储能设施,也让这座算力枢纽在用电成本与绿色属性上同时占优。

16万颗昇腾950DT,国产推理芯片的最大规模订单

此次部署的昇腾950DT芯片,是华为昇腾家族面向推理场景的主力型号。此前的对比数据显示,昇腾950系列的算力指标并非单卡最强,其单卡性能约为英伟达H100的一半水平,但卡间互联带宽达到1800GB/s的惊人水准,远超同级产品,这一特性恰好契合大模型推理中多卡协同高并发的工作模式。DeepSeek选择950DT而非追求单卡性能最强的型号,说明其对集群规模效应的看重,互联带宽才是推理集群吞吐量的真正瓶颈。

16万颗的采购规模对华为昇腾产线而言同样是里程碑级别的订单。当前华为昇腾产能主要由中芯国际的成熟制程承接,年产能面临诸多约束,16万颗芯片的体量足以占据昇腾产能的相当比例,也让DeepSeek在芯片供应链中的地位从普通客户上升为核心大客户。对国产AI芯片产业来说,这是继运营商集采之后最大规模的商业订单之一,头部大模型公司的真金白银下单,比任何政策扶持都更能证明国产芯片在推理场景已经具备规模化的可用性。更深层的信号在于,推理芯片的采购一旦形成规模效应,会反向推动昇腾工具链与算子库的快速成熟,形成应用牵引生态的正循环,这是单纯依靠政策补贴难以达成的效果。

从英伟达到昇腾,DeepSeek算力栈的攻守转换

DeepSeek的算力路线一直备受关注。作为开源模型的标杆玩家,DeepSeek早期训练主要依赖英伟达芯片,其V3与R1模型的训练成本优势一度被认为是"用更少算力做出更强模型"的典范;而随着美国出口管制持续收紧,国内大模型厂商获取英伟达最新芯片的通道不断收窄,DeepSeek不得不把重心转向国产算力。此次内蒙古1吉瓦中心的规划,标志着这家公司从训练阶段的被动适配,转向推理阶段的主动大规模国产化布局。

这一转向背后是清晰的商业考量。训练可以依赖少量高端芯片反复使用,推理却是随用户规模线性增长的持续消耗,C端产品的日活越高,推理算力的成本占比就越大。在高端英伟达芯片供应受限的背景下,用国产芯片撑起推理底座、把昂贵的海外算力留给训练,是成本与供应链安全双重约束下的最优解。DeepSeek的选择也为其他大模型公司提供了样板,当国产推理芯片的性价比在真实生产环境中得到验证,整个行业的算力采购逻辑都可能随之改变。

算力自主的深水区,推理中心背后的产业信号

放在更大的产业图景里看,DeepSeek的内蒙古项目是国产算力自主进程进入深水区的标志。此前的国产化努力更多集中在政府与运营商的智算中心采购,商业公司的大规模部署仍以英伟达为主;而DeepSeek作为商业化最成功的大模型创业公司之一,用16万颗昇腾芯片的实际订单证明,国产AI芯片不仅能在政策驱动下出货,也能在头部商业客户的真实负载中扛起生产级推理任务,这对华为昇腾生态与整个国产芯片产业都是极强的信心注入。

当然,挑战依然存在。国产芯片在良率、软件生态与开发工具链上与英伟达仍有差距,16万颗芯片的集群能否长期稳定运行、推理效率能否达到设计预期,都需要真实运营数据的检验;1吉瓦数据中心的建设周期与资金投入也相当可观,对DeepSeek的现金流是持续的考验。但方向已经清晰,当算力成为大模型竞争的核心变量,谁能把国产算力栈用得最顺、成本压得最低,谁就掌握了下一阶段竞争的主动权,DeepSeek正在用这座1吉瓦的推理之城,写下自己的答案。

素材来源:彭博社、IT之家、腾讯新闻 发布时间:2026-09-07