华为昇腾芯片命名规则与Atlas算力产品体系全解析(从910C到950DT/960DT)
华为昇腾芯片命名规则与 Atlas 算力产品体系全解析(从 910C 到 950DT/960DT)
面向专业算力从业者 · 基于公开资料整理(华为官方、公众号、知乎/社区、券商研报等,2026-09)
关键词:昇腾 Ascend、910C/950PR/950DT/960DT、Atlas、超节点 SuperPoD、集群
一、为什么命名值得单独讲?
昇腾(Ascend)是华为自研的 AI 加速芯片(NPU,对标通用 GPU),采用达芬奇(Da Vinci)架构。对算力从业者而言,芯片型号、服务器型号的命名不仅是一串代号,更是产品定位、代际、场景取向的直接编码。看懂“910C”“950DT”“Atlas 950 SuperPoD”分别意味着什么,才能准确选型、评估算力体系和判断国产 AI 基础设施演进方向。
二、昇腾芯片命名体系(Ascend ×××)
华为 AI 芯片采用“品牌 + 三位数字 + 后缀”三段式命名:
- Ascend:昇腾品牌(NPU)。
- 数字首位:决定产品定位,数字越大越面向云端高端算力。
- 后缀字母/组合:表示子代变体或场景定位。
2.1 首位数字 = 定位代次
| 系列 | 定位 | 典型形态 |
|---|---|---|
| Ascend 310 系列 | 边缘推理(低功耗 ~8W) | 智能摄像头、机器人、边缘盒子(Atlas 200I/500/300I) |
| Ascend 510/610 系列 | 边缘训练+推理一体 | 部分工业场景 |
| Ascend 710/810 系列 | 中端推理/过渡代 | — |
| Ascend 910/920 系列 | 云端训练/推理旗舰 | 数据中心服务器、超节点核心 |
| Ascend 950/960/970/980 | 新一代云端旗舰(2026 起逐年) | 超节点核心计算芯片 |
一句话:3/5/6 系列偏边缘,9 系列是云端训练/推理主战场;310 系列无训练能力,模型训练必须上 9 系列。
2.2 910 系列:字母后缀 = 合封/子代变体
昇腾 910 是国产大模型训练主力,后缀含义清晰:
- 910A:2019 首发版本,FP16 ~256 TFLOPS、32GB HBM2。
- 910B:工艺优化版(7nm),FP16 320 TFLOPS、INT8 640 TOPS、32GB HBM2;内部还分 B1/B2/B3,其中 B3 引入 HBM3e,带宽提至 1.2TB/s,支持万亿参数训练。
- 910C:两颗 910B 双 Die 合封(Chiplet),7nm(N+2),晶体管约 530 亿颗,FP16 单卡约 640–800 TFLOPS(约 H100 的 80%),配 128GB HBM2e / ~3.2TB/s——当前规模化商用主力。
- 920:Chiplet 优化集群扩展方向的系列。
- 910C 还分标准版(单卡/8 卡小集群,HCCS/PCIe 互联)与超节点版(Atlas 900 A3 内 384 卡全光互联)。
2.3 950 系列:PR / DT 后缀 = 场景化命名(重点)
950 的最大创新是“一芯双构”:基于同一颗 Ascend 950 Die,搭配不同自研 HBM 合封成两款芯片——
| 型号 | 缩写全称 | 含义 | 主打场景 | 配套 HBM/带宽 |
|---|---|---|---|---|
| 昇腾 950PR | Prefill & Recommendation | 预填充+推荐 | 推理 Prefill 阶段、电商/信息流推荐(算力密集、带宽需求相对低) | HiBL 1.0,约 128GB/1.6TB·s(部分口径 144GB/4TB·s) |
| 昇腾 950DT | Decode & Training | 解码+训练 | 逐 Token 解码生成、高负载训练(访存密集、带宽优先、容量要大) | HiZQ 2.0,144GB/4TB·s |
- 核心洞察:大模型推理的 Prefill(一次性处理整段提示词、建 KV 缓存)与 Decode(逐 Token 生成、反复读写缓存)是两套截然不同的负载——前者算力密集、后者访存/带宽密集,用同一颗芯片两头都不极致。华为按负载特征做产品分工,并配套自研 HBM(HiBL 1.0 / HiZQ 2.0),一并突破 HBM 供应瓶颈。
- 相比 910C,950 系列引入 SIMD/SIMT 双编程模型、支持 FP8/MXFP8/MXFP4/HiF8/HiF4 等多低精度、片间互联提至 2TB/s(约 910C 的 2.5 倍)。
- 节奏:950PR 2026 Q1,950DT 2026 Q4。
2.4 960/970/980:一年一代(韬(τ)定律)
华为提出“韬(τ)定律——时间缩微替代”,保持一年一代、算力翻倍:
| 芯片 | FP8 | FP4 | HBM | 节奏 |
|---|---|---|---|---|
| Ascend 910C | — | — | 128GB/3.2TB·s | 已规模商用 |
| Ascend 950PR/DT | 1 PFLOPS | 2 PFLOPS | 128–144GB | 2026 量产 |
| Ascend 960DT | 2 PFLOPS | 4 PFLOPS | 288GB/9.6TB·s | 2027 Q1(提前就绪) |
| Ascend 960PR | — | 8 PFLOPS | — | 2027 Q3 |
| Ascend 970 | 4 PFLOPS | 8 PFLOPS | 内存/带宽翻倍 | 2028 |
| Ascend 980 | 继续翻倍 | 2029 |
命名逻辑总结:数字 = 能力代际(910→950→960→970→980);字母(A/B/C)= 合封/子代变体;PR/DT = 场景定位(Prefill/推荐 vs Decode/训练)。
三、Atlas 算力产品命名体系与分类
Atlas 是华为 AI 计算硬件品牌(昇腾芯片的整机/板卡/服务器/超节点产品线),命名规则:Atlas + 型号数字 + 形态/场景后缀 + 代次。
3.1 后缀含义
- T = Training(训练)、I = Inference(推理),如 Atlas 800T / 800I。
- A3 / A2 = 代次代号(第 3/第 2 代 Atlas 900 平台),A3 当前主流(昇腾 910C/950 载体)。
- SuperPoD = 超节点(PoD 源自数据中心资源单位,指“内部已高度互联、可做统一算力单元的资源池”)。
- SuperCluster = 超节点集群(多个超节点级联)。
- Box = 小型整机/盒子(如 A200T A3 Box8,8 卡)。
3.2 产品由小到大分层
| 层级 | 产品形态 | 代表型号 | 规模/算力 |
|---|---|---|---|
| 单机/Box | 单台服务器 | Atlas 800T A3(训练)、800I A3(推理)、A200T A3 Box8 | 单机 8×910+4×鲲鹏920,FP16 最高 ~6 PFLOPS |
| 超节点 SuperPoD | 逻辑一台“超级计算机” | Atlas 900 A3 SuperPoD(灵衢1.0) | 384 卡,2025 商用数百套 |
| Atlas 950 SuperPoD | 满配 8192 卡(首秀 1024 卡),FP8 8E/FP4 16E、16.3PB·s、1152TB、液冷,2026 Q4 | ||
| Atlas 960 SuperPoD | 15488 卡,2027 Q4 | ||
| 超节点集群 SuperCluster | 多超节点级联 | Atlas 950 SuperCluster | >50 万卡,UB 组网,2026 Q4 |
| Atlas 960 SuperCluster | 100 万卡,2027 Q4 | ||
| 云形态 | 资源池/云服务 | CloudMatrix 384 / 昇腾 AI 云 | 384 卡超节点云上产品化封装 |
| 通用计算超节点 | CPU 超节点(鲲鹏) | TaiShan 950 SuperPoD | 数据库/大型机小型机替代 |
3.3 常见型号速查
- Atlas 800T A3(训练)/ 800I A3(推理):10U、单机 8×910+4×鲲鹏920、D2D 784GB·s,可组最大 384 卡超节点——单机/中小集群主力。
- Atlas 900 A3 SuperPoD:384 卡超节点、灵衢 1.0,CloudMatrix 384 的硬件载体——上一代已商用超节点。
- Atlas 950 SuperPoD:1024–8192 卡、灵衢 2.0 全光互联、全液冷——当前最强单体超节点(对应 950DT)。
- Atlas 960 SuperPoD:4096–15488 卡、业界首个量产 NPO 光引擎 Hi-ONE(7.2Tbps)、HBM 1PB、可用度 99.8%。
- Atlas 950/960 SuperCluster:50 万 / 100 万卡超节点集群。
- Atlas 650E:灵衢下探的一体机(双机灵衢直连 16 NPU 免交换、风冷,支撑中小企业本地跑大模型)。
- TaiShan 950 SuperPoD:通用计算超节点(鲲鹏),大机小型机替代。
四、命名体系洞察
- 芯片 vs 整机双线命名:昇腾(Ascend)管“芯”、Atlas 管“机”,通过型号数字对应(910 芯片 → Atlas 800/900/950 服务器/超节点)。
- 场景化后缀是趋势:从 910 时代“字母表变体”(A/B/C),到 950 时代“场景缩写”(PR/DT),再到 960 代 960DT/960PR,华为越来越按负载特征切产品。
- 系统级视角 > 单卡:超节点命名(SuperPoD/SuperCluster)体现“多机作一机”,竞争焦点从单芯片转向“芯片+互联+内存+存储+软件”全栈;评估更应该看单位 Token 成本、MFU、KV Cache 命中率而非单纯峰值算力。
- 韬(τ)定律驱动节奏:一年一代、算力翻倍,2026 950 → 2027 960 → 2028 970 → 2029 980,超节点规模同步迈向 100 万卡。
信息来源:公开资料整理(华为官方新闻/全联接大会、华为云与昇腾开发者社区、知乎、CSDN/DevPress、券商研报及产业媒体、微信公众号及社区解析等,2026-09)。本文由 AI 辅助整理,具体参数与上市节奏以华为官方最新公告为准。
更多推荐



所有评论(0)