华为昇腾芯片命名规则与Atlas算力产品体系全解析(从910C到950DT/960DT)
华为昇腾芯片命名规则与 Atlas 算力产品体系全解析从 910C 到 950DT/960DT声明本文作为笔者个人备忘的文章不喜勿喷。 · 基于公开资料整理华为官方、公众号、知乎/社区、券商研报等2026-09关键词昇腾 Ascend、910C/950PR/950DT/960DT、Atlas、超节点 SuperPoD、集群一、为什么命名值得单独讲昇腾Ascend是华为自研的 AI 加速芯片NPU对标通用 GPU采用达芬奇Da Vinci架构。对算力从业者而言芯片型号、服务器型号的命名不仅是一串代号更是产品定位、代际、场景取向的直接编码。看懂“910C”“950DT”“Atlas 950 SuperPoD”分别意味着什么才能准确选型、评估算力体系和判断国产 AI 基础设施演进方向。二、昇腾芯片命名体系Ascend ×××华为 AI 芯片采用“品牌 三位数字 后缀”三段式命名Ascend昇腾品牌NPU。数字首位决定产品定位数字越大越面向云端高端算力。后缀字母/组合表示子代变体或场景定位。2.1 首位数字 定位代次系列定位典型形态Ascend 310 系列边缘推理低功耗 ~8W智能摄像头、机器人、边缘盒子Atlas 200I/500/300IAscend 510/610 系列边缘训练推理一体部分工业场景Ascend 710/810 系列中端推理/过渡代—Ascend 910/920 系列云端训练/推理旗舰数据中心服务器、超节点核心Ascend 950/960/970/980新一代云端旗舰2026 起逐年超节点核心计算芯片一句话3/5/6 系列偏边缘9 系列是云端训练/推理主战场310 系列无训练能力模型训练必须上 9 系列。2.2 910 系列字母后缀 合封/子代变体昇腾 910 是国产大模型训练主力后缀含义清晰910A2019 首发版本FP16 ~256 TFLOPS、32GB HBM2。910B工艺优化版7nmFP16 320 TFLOPS、INT8 640 TOPS、32GB HBM2内部还分B1/B2/B3其中B3 引入 HBM3e带宽提至 1.2TB/s支持万亿参数训练。910C两颗 910B 双 Die 合封Chiplet7nmN2晶体管约 530 亿颗FP16 单卡约 640–800 TFLOPS约 H100 的 80%配 128GB HBM2e / ~3.2TB/s——当前规模化商用主力。920Chiplet 优化集群扩展方向的系列。910C 还分标准版单卡/8 卡小集群HCCS/PCIe 互联与超节点版Atlas 900 A3 内 384 卡全光互联。2.3 950 系列PR / DT 后缀 场景化命名重点950 的最大创新是“一芯双构”基于同一颗Ascend 950 Die搭配不同自研 HBM合封成两款芯片——型号缩写全称含义主打场景配套 HBM/带宽昇腾 950PRPrefill Recommendation预填充推荐推理 Prefill 阶段、电商/信息流推荐算力密集、带宽需求相对低HiBL 1.0约 128GB/1.6TB·s部分口径 144GB/4TB·s昇腾 950DTDecode Training解码训练逐 Token 解码生成、高负载训练访存密集、带宽优先、容量要大HiZQ 2.0144GB/4TB·s核心洞察大模型推理的 Prefill一次性处理整段提示词、建 KV 缓存与 Decode逐 Token 生成、反复读写缓存是两套截然不同的负载——前者算力密集、后者访存/带宽密集用同一颗芯片两头都不极致。华为按负载特征做产品分工并配套自研 HBMHiBL 1.0 / HiZQ 2.0一并突破 HBM 供应瓶颈。相比 910C950 系列引入 SIMD/SIMT 双编程模型、支持 FP8/MXFP8/MXFP4/HiF8/HiF4 等多低精度、片间互联提至 2TB/s约 910C 的 2.5 倍。节奏950PR 2026 Q1950DT 2026 Q4。2.4 960/970/980一年一代韬(τ)定律华为提出“韬(τ)定律——时间缩微替代”保持一年一代、算力翻倍芯片FP8FP4HBM节奏Ascend 910C——128GB/3.2TB·s已规模商用Ascend 950PR/DT1 PFLOPS2 PFLOPS128–144GB2026 量产Ascend 960DT2 PFLOPS4 PFLOPS288GB/9.6TB·s2027 Q1提前就绪Ascend 960PR—8 PFLOPS—2027 Q3Ascend 9704 PFLOPS8 PFLOPS内存/带宽翻倍2028Ascend 980继续翻倍2029命名逻辑总结数字 能力代际910→950→960→970→980字母A/B/C 合封/子代变体PR/DT 场景定位Prefill/推荐 vs Decode/训练。三、Atlas 算力产品命名体系与分类Atlas是华为 AI 计算硬件品牌昇腾芯片的整机/板卡/服务器/超节点产品线命名规则Atlas 型号数字 形态/场景后缀 代次。3.1 后缀含义T Training训练、I Inference推理如 Atlas 800T / 800I。A3 / A2代次代号第 3/第 2 代 Atlas 900 平台A3 当前主流昇腾 910C/950 载体。SuperPoD超节点PoD 源自数据中心资源单位指“内部已高度互联、可做统一算力单元的资源池”。SuperCluster超节点集群多个超节点级联。Box 小型整机/盒子如 A200T A3 Box88 卡。3.2 产品由小到大分层层级产品形态代表型号规模/算力单机/Box单台服务器Atlas 800T A3训练、800I A3推理、A200T A3 Box8单机 8×9104×鲲鹏920FP16 最高 ~6 PFLOPS超节点 SuperPoD逻辑一台“超级计算机”Atlas 900 A3 SuperPoD灵衢1.0384 卡2025 商用数百套Atlas 950 SuperPoD满配 8192 卡首秀 1024 卡FP8 8E/FP4 16E、16.3PB·s、1152TB、液冷2026 Q4Atlas 960 SuperPoD15488 卡2027 Q4超节点集群 SuperCluster多超节点级联Atlas 950 SuperCluster50 万卡UB 组网2026 Q4Atlas 960 SuperCluster100 万卡2027 Q4云形态资源池/云服务CloudMatrix 384 / 昇腾 AI 云384 卡超节点云上产品化封装通用计算超节点CPU 超节点鲲鹏TaiShan 950 SuperPoD数据库/大型机小型机替代3.3 常见型号速查Atlas 800T A3训练/ 800I A3推理10U、单机 8×9104×鲲鹏920、D2D 784GB·s可组最大 384 卡超节点——单机/中小集群主力。Atlas 900 A3 SuperPoD384 卡超节点、灵衢 1.0CloudMatrix 384 的硬件载体——上一代已商用超节点。Atlas 950 SuperPoD1024–8192 卡、灵衢 2.0 全光互联、全液冷——当前最强单体超节点对应 950DT。Atlas 960 SuperPoD4096–15488 卡、业界首个量产NPO 光引擎 Hi-ONE7.2Tbps、HBM 1PB、可用度 99.8%。Atlas 950/960 SuperCluster50 万 / 100 万卡超节点集群。Atlas 650E灵衢下探的一体机双机灵衢直连 16 NPU 免交换、风冷支撑中小企业本地跑大模型。TaiShan 950 SuperPoD通用计算超节点鲲鹏大机小型机替代。四、命名体系洞察芯片 vs 整机双线命名昇腾Ascend管“芯”、Atlas 管“机”通过型号数字对应910 芯片 → Atlas 800/900/950 服务器/超节点。场景化后缀是趋势从 910 时代“字母表变体”A/B/C到 950 时代“场景缩写”PR/DT再到 960 代 960DT/960PR华为越来越按负载特征切产品。系统级视角 单卡超节点命名SuperPoD/SuperCluster体现“多机作一机”竞争焦点从单芯片转向“芯片互联内存存储软件”全栈评估更应该看单位 Token 成本、MFU、KV Cache 命中率而非单纯峰值算力。韬(τ)定律驱动节奏一年一代、算力翻倍2026 950 → 2027 960 → 2028 970 → 2029 980超节点规模同步迈向 100 万卡。信息来源公开资料整理华为官方新闻/全联接大会、华为云与昇腾开发者社区、知乎、CSDN/DevPress、券商研报及产业媒体、微信公众号及社区解析等2026-09。本文由 AI 辅助整理具体参数与上市节奏以华为官方最新公告为准。