DeepSeek于9月30日宣布开源面向华为昇腾平台的基础设施组件,涵盖TileLang高级语言编译工具、计算库和分布式通信库。它们分别涉及算子编写、矩阵计算与跨卡通信,并与DeepSeek此前面向英伟达平台开源的相关组件对应。这是国产大模型工具栈适配的一项进展,但不等于DeepSeek已经摆脱英伟达,也不能据此推断两套平台性能相同。

开源组件具体降低了哪些适配成本

对开发者而言,训练框架之外,算子怎么写、计算如何优化、多个加速卡之间如何交换数据,都会影响模型能否在目标硬件上运行。此次开源把这几类基础工具纳入昇腾适配范围,团队可在公开组件基础上开展开发和验证,不必所有底层工具都从零搭建。

DeepSeek开源昇腾平台基础组件:TileLang等工具栈全面适配,128卡超节点方案能否降低国产算力训练门槛?

其中,TileLang面向算子编写与编译;计算库承接矩阵等计算任务;分布式通信库则服务于多卡协同。组件与此前英伟达平台相关开源组件相对应,意味着已有工具和开发经验有机会复用,降低从工具选择、代码适配到分布式训练接入的部分成本。

但“降低适配成本”不等于“无需适配”。开发者仍需针对昇腾环境处理算子兼容、调试与性能调优,并验证模型框架、训练流程和集群部署是否满足自身需求。开源提供了工具基础,实际效果还取决于版本成熟度、文档、社区支持以及项目团队的工程能力。

128卡超节点,能让中小团队直接受益吗

双方还在推进基于昇腾950的128卡超节点方案。对大规模训练而言,超节点的意义在于把多卡协同作为系统工程推进,重点不仅是卡的数量,也包括计算、通信与集群组织之间的配合。对行业来说,这类方案能否落地,将是观察国产算力能否承接复杂训练任务的一个方向。

不过,128卡方案并不意味着中小团队就能以较低成本拥有同等规模的训练资源。对多数创业团队和研发小组,更现实的受益路径可能是通过云服务、算力平台或合作机构使用相关资源;其可用性、价格、排队情况和软件支持,仍需看后续公开信息与实际服务。现阶段也不宜把方案推进解读为已经完成商业交付或性能验证。

昇腾供应量能否支撑规模化商业应用

目前可确认的信息聚焦于基础组件开源和超节点方案推进,不能据此判断昇腾供应量、交付节奏或大规模商业化能力。相关供货与排产传闻若缺少可靠依据,不应作为结论。企业评估国产算力时,除了关注硬件供应,还应核实可采购规模、交付周期、运维支持、软件适配范围和整体使用成本。

【软盟资讯观察】

这次开源的价值,不在于一句“国产替代”,而在于把算子、计算和通信这些开发者实际依赖的基础环节纳入昇腾生态,尝试降低迁移与试验的起步成本。若工具持续维护、文档和社区逐步完善,企业和创业团队就有更多机会在真实项目中评估国产算力,供应商也能获得来自应用侧的反馈。

但工具开放只是生态建设的一环。团队最终关心的仍是稳定性、训练效率、迁移工作量、可获得算力和总成本;128卡方案也要经过真实部署与持续运行检验。冷静看待这类进展,既不把开源直接等同于完成脱钩,也不因尚无供货结论而忽视工具生态的积累。更关键的指标,是后续能否形成可复用的软件、可靠的算力服务与可验证的商业交付。