DeepSeek被曝将采购16万颗华为昇腾950DT

  (文/汤普济编辑/吕栋)

  9 月 4 日,据彭博社援引知情人士消息,DeepSeek 计划在内蒙古建设的大型数据中心部署至少 16 万颗华为下一代昇腾 950DT 芯片,用于模型推理。

  若按计划完成,这将成为目前已知规模最大的国产 AI 芯片集群之一。项目规划达功率达到吉瓦级,拟部署的 16 万颗芯片仅对应其中一部分容量。具体安装进度仍取决于供应能力,全部交付可能需要一年以上。

  双方的合作也延伸至算力系统设计,DeepSeek 与华为联合定义昇腾超节点,围绕长文本推理降低时延、提升吞吐并控制成本,同时兼顾向万卡级集群扩展的需求。

  DeepSeek 还称,受限于高端算力,4-Pro 的 API 服务吞吐十分有限,预计下半年昇腾 950 超节点批量上市后,Pro 价格将大幅下调。

  此次采购计划涉及的昇腾 950DT 属于昇腾 950 系列。按照华为轮值董事长徐直军 2025 年 9 月 18 日在华为全联接大会上公布的规划,该芯片将于 2026 年第四季度推出,更侧重推理解码和训练场景。

  针对这些场景对数据读取和芯片间通信的较高要求,该芯片规划配备 144GB 内存,内存访问带宽达到 4TB/s,互联带宽提升至 2TB/s。

  与昇腾 950DT 同步推出的,还有基于该芯片打造的 Atlas 950 超节点,最多支持 8192 张昇腾卡,上市时间同样为今年第四季度。

  Atlas 950 超节点通过华为自研的“灵衢”互联技术,让芯片之间高速交换数据、协同处理任务。徐直军解释道,超节点虽然在物理上由多台机器组成,但能够像一台计算机一样完成学习、思考和推理。

  不过,目前公开信息尚未披露 DeepSeek 项目的具体组网方案。

  国产人工智能模型和芯片开发商不断壮大彭博社

  其他项目也在持续推进国产算力大规模部署。今年 3 月 26 日,深圳投建的 11000P 智能算力集群正式点亮,加上此前投运部分,合计建成 14000P 智能算力。

  6 月 30 日,美团发布 LongCat-2.0 大模型,并表示该模型已在五万卡国产算力集群上完成从零预训练到推理的全流程,将国产算力用于万亿参数模型训练。

  7 月,彭博社还报道,智谱已建成一座规划功率约 1 吉瓦、采用国产芯片的数据中心,部分设施已投入运营,用于训练 GLM 系列模型。

  本文系观察者网独家稿件,未经授权,不得转载。