昇腾950价格没有一口价:同一个"昇腾950"名下,芯片分 950PR 与 950DT 两条路线,每条还各有两档片上内存规格;同一颗芯装进标卡、插卡服务器、模组整机和超节点之后,报价能差三个数量级。所以问"多少钱一颗"之前,得先锁定你问的是哪一层、哪一档、哪一种货。
这三句话不是绕弯,是采购现场真金白银的教训。我们见过太多项目在第一轮谈判就崩掉,原因不是价格谈不拢,而是两边说的"一颗"根本不是同一个东西。
一、先把名字切开:四种"一颗"对应四个价格层级
| 你说的"一颗" | 实际是什么 | 谁在用这个词 | 计价单位 |
|---|---|---|---|
| 一颗芯片 | Ascend 950PR / 950DT 裸片合封后的成品芯片 | 方案商、OEM 整机厂 | 元/颗 |
| 一张卡 | Atlas 350 加速卡(采用 Ascend 950PR)等标卡 | 服务器集成商、互联网客户 | 元/张 |
| 一台机器 | Atlas 650 / 650E / 750 等 8 卡或插卡服务器 | 企业 IT、行业集成商 | 元/台 |
| 一个集群 | Atlas 850E 风冷与 Atlas 950 SuperPoD 液冷超节点 | 智算中心、运营商 | 元/柜、元/套 |
这张表看着像常识,但它是最容易出错的一环。甲方按"芯片价"做预算、乙方按"整机价"报方案,两边都觉得自己没错,项目却停在那里。
二、第二层差价:同一颗芯,官方自己就有两个规格档
昇腾950 采用"一芯双构"设计——950PR 与 950DT 共用同一个 Ascend 950 Die 计算核心,区别在外挂什么片上内存:950PR 配 HiBL 1.0,950DT 配 HiZQ 2.0。名字里的 PR 和 DT 也有官方定义:PR 是 Prefill & Recommendation(预填充与推荐),DT 是 Decode & Training(解码与训练)。

翻译成采购语言:PR 型负责把长提示一次性吞下去,DT 型负责逐字生成、还要扛训练。 拿物流打比方,PR 是分拣中心的卸货口,DT 是干线车队——卸货口堵了整体就慢,车队不够就跑不远,但两边的成本结构完全不同。
关键在于官方规格表里的写法。看华为《昇腾950 NPU 架构白皮书》表 3-1 的 Memory 一栏:
| 规格项 | 昇腾 950PR | 昇腾 950DT |
|---|---|---|
| 片上内存容量 | 128 / 112 GB | 144 / 96 GB |
| 片上内存带宽 | 1.6 / 1.4 TB/s | 4 TB/s |
| Cube Core 数量 | 32 / 28 | 36 / 32 / 28 |
| Vector Core 数量 | 64 / 56 | 72 / 64 / 56 |
| 总算力 MXFP4 | 1784 / 1561 TFLOPS | 2007 / 1784 / 1561 TFLOPS |
| 总算力 HiF8/MXFP8/FP8 | 919 / 804 TFLOPS | 1034 / 919 / 804 TFLOPS |
| 总算力 BF16/FP16 | 486 / 425 TFLOPS | 547 / 486 / 425 TFLOPS |
| 总算力 TF32 | 243 / 212 TFLOPS | 273 / 243 / 212 TFLOPS |
斜杠前是满配档,斜杠后是精简档。同样叫 950PR,片上内存可以是 128GB,也可以是 112GB;同样叫 950DT,可以是 144GB,也可以是 96GB。 这不是渠道乱报,是官方规格本身就允许多个版本。白皮书原话是:"结合精细的冗余设计,昇腾950PR 和昇腾950DT 会进一步衍生出多个不同规格的版本,并应用于不同的产品形态中。"
同名的第二个坑在产品形态上。昇腾官方 Atlas 350 加速卡页写的是"112 GB HBM,带宽 1.4TB/s",对应白皮书里 950PR 的精简档;而昇腾 NPU 处理器页对 950PR 的表述是"最大配备 128GB、1.6TB/s",是满配档。两个页面都对,说的是不同版本。
所以有人说"昇腾950PR 是 84GB 显存",也不一定错——那通常是特定风冷整机机型的模组配置。报价单要准,就必须先锁定是哪一档。
三、第三层差价:同一颗芯,装进六种完全不同的产品
规格档定完,下一个变量是形态。950 新品覆盖范围从单张标卡一直到 1024 卡超节点,中间隔了五个台阶。

上图正中那行红字是采购现场最实用的一句口诀,建议直接背下来:服务器型号带 E 的用 950DT 芯片,不带 E 的用 950PR 芯片。 比如 Atlas 650E 是 DT,Atlas 650 是 PR。报错芯片型号的案例,多数是后缀字母看漏了。
按官方公开规格,六个台阶大致这样分布:
| 产品形态 | 代表型号 | 芯片 | 官方公开表述 | 适合谁 |
|---|---|---|---|---|
| 加速标卡 | Atlas 350 | 昇腾950PR | 1561 TFLOPS mxFP4;112GB HBM,1.4TB/s;≤600W 被动散热 | 已有服务器想加卡、推荐场景 |
| 插卡服务器 | Atlas 750 | 昇腾950PR | 可插 1–8 张 Atlas 150 标卡 | 算力按需增长、分批投入 |
| 8卡模组服务器 | Atlas 650 | 昇腾950PR | 8 卡模组形态 | AI 一体机、百亿级模型推理 |
| 单双机一体机 | Atlas 650E | 昇腾950DT | 单机 8 颗 NPU,最大 12.48 PFLOPS mxFP4;8×96GB HBM,4.0TB/s;14U;最大输入功耗 14.5kW | 中等并发企业推理、Agent 应用 |
| 风冷超节点 | Atlas 850E | 昇腾950DT | 风冷形态超节点 | 企业级风冷数据中心、后训练 |
| 液冷超节点 | Atlas 950 SuperPoD | 昇腾950DT | WAIC 2026 公开:1024 卡规模、1 EFLOPS FP8、256TB 统一内存编址 | 万亿级训练、超大规模推理 |
这张表里最值得对照的是 Atlas 650 和 Atlas 650E:两者都是 8 卡机器,标称算力都是 8×804 TFLOPS@mxFP8,互联带宽都是每 NPU 1.68 TB/s,唯一差别是显存——96GB@4.0TB/s 对 84GB@1.4TB/s。

容量差 12GB,带宽差了将近 3 倍。做长上下文推理或训练,这个差别直接决定能不能跑、跑多快;只做短提示的推荐推理,那 84GB 和 1.4TB/s 可能完全够。同样的机箱、同样的卡数、同样的标称算力,报价差一截的核心就在这里。
四、第四层差价:市场上四种货,价格排成一个阶梯
前两层是产品本身的差异,这一层是渠道状态的差异,最容易被忽略,也最容易吃亏。
| 货源状态 | 特征 | 价格位置 | 主要风险 |
|---|---|---|---|
| 官方项目制询价 | 走华为项目流程,无公开标价,按配置与规模报价 | 基准 | 周期长,需具备立项条件 |
| 授权渠道现货 | 已到货可立即交付,型号与规格可核验 | 略高 | "声称现货"的居多,需验真 |
| 期货 / 配额订单 | 已锁产能,按排期交付,通常需定金 | 较低至基准 | 交付期不可控,合同是唯一保障 |
| 二手 / 翻新 / 非授权 | 来源不明,可能无原厂保修 | 异常低 | 保修主体缺失,出问题无人兜底 |
一个马上能用的判断法:报价显著低于同期市场、同时又声称"现货"的,基本都是第四类。 在芯片涨价周期里,"低价现货"这四个字本身就矛盾。
这里必须说清一件事:华为官方渠道从不公布昇腾芯片标价。 昇腾官网所有产品页用的都是"项目咨询"入口,没有任何价格数字。市面上流传的报价,全部来自媒体报道、券商研报或渠道转述,属于市场参考口径,不是官方定价。
按公开报道整理(2026 年 9 月前后,仅供量级参考):
| 口径 | 市场参考价 | 条件说明 | 来源类型 |
|---|---|---|---|
| 昇腾950PR 芯片(DDR 显存版) | 约 5 万元/颗 | 早期 Reuters 转述口径 | 媒体转述 |
| 昇腾950PR 芯片(HBM 版) | 约 7 万元/颗 | 多家财经媒体报道 | 媒体口径 |
| Atlas 350 加速卡(整卡) | 约 7 万元/张 | 发布时公开报道 | 媒体口径 |
| 昇腾950DT | 突破 25 万元/颗 | HBM 供应紧张推动,2026 年 9 月 | Reuters / TrendForce |
| 8 卡整机(950 平台) | 90 万–100 万元/台 | 综合渠道信息 | 第三方平台汇总 |
必须分开看的是最后一行。 前三行属于常规区间;950DT 突破 25 万是HBM 供应紧张这一特殊时点的极端值——TrendForce 在 2026 年 9 月 10 日的报道中指出,受高带宽内存成本上升影响,中国 AI 芯片厂商对在售与下一代产品普遍调价,最高涨幅约 50%,华为昇腾 950DT 报价被推到 25 万元以上。把它当成长期均价,会系统性高估预算。
反过来,如果项目周期允许排期,在当前时点锁定期货配额,成本结构通常比追现货更可控——这是过去半年里我们见到最多的选择。
五、货期:为什么"有货"和"没货"能差出一台机器的钱
昇腾950 的上市节奏是公开的:950PR 于 2026 年 3 月 20 日在华为中国合作伙伴大会 2026 上正式发布,4 月起进入量产;950DT 随后在 2026 年 8 月上线;超节点产品在下半年进入批量上市阶段。
但"上市了"和"你那台什么时候到"是两件事。货期差异来自三个层面:
一、按配置排产还是按库存出货。 标准配置通常有滚动库存;非标配置(特殊盘位、特定电源、定制网络)要走排产。这也是为什么同一款机器,A 客户两周到货、B 客户要等两个月——不是厚此薄彼,是配置不同。
二、规格档位的稀缺度。 满配档产能天然更紧张,尤其在上游 HBM 吃紧的周期里。如果你能接受精简档,货期往往立刻缩短。 这不是让你降配,是让你知道谈判桌上有一个可换的筹码。
三、交付条件的准备程度,这条最容易被忽略。 昇腾950 平台的功耗和散热要求明显高于上一代。以官方公开的 Atlas 650E 为例:14U 机架、最大输入功耗 14.5kW、整机集成 30 个风扇模组、双机场景整机 NPU 互联带宽 13.4 TB/s。这些数字背后是三个现实问题:机柜供电够不够、机房承重和散热扛不扛得住、布线空间有没有预留。
我们见过最典型的翻车场景是:货到了,机房装不进去。 机器在仓库躺了三周,客户在改配电、加固地板、等空调扩容——时间成本远超设备本身。所以下面这份清单虽然不是报价单的一部分,却决定了你的货期是真的两周,还是名义两周。
六、发起询价前,先把这 8 件事定下来
| 序号 | 必须先确认的项 | 为什么它影响价格 |
|---|---|---|
| 1 | 你要的是芯片、加速卡、整机还是超节点 | 四个层级的价格差三个数量级 |
| 2 | 芯片是 950PR 还是 950DT;服务器型号带不带 E | 决定预填充型还是解码/训练型,价格体系不同 |
| 3 | 需要哪一档片上内存(如 128GB 还是 112GB) | 满配档与精简档是两个价 |
| 4 | 卡数与整机形态(8 卡模组 / 插卡 / 单双机) | 形态决定主板、供电、散热与机箱成本 |
| 5 | 负载类型与并发(预填充为主还是解码为主) | 决定选 PR 还是 DT,选错等于白花钱 |
| 6 | 交付地点与机房条件(供电、承重、散热余量) | 不满足条件就要追加改造预算 |
| 7 | 是现货还是接受排期 | 现货溢价与期货折价是两个方向 |
| 8 | 保修主体与响应条款 | 非授权货源的"便宜"就藏在这一项里 |
任何一家供应商,如果在你还没说清这 8 项之前就给出了确定报价,这个报价大概率不可信。
这里有个反常识的点值得展开:不是所有项目都该等 950。 如果模型规模在百亿级、并发不高、软件栈已经在昇腾上跑通,910B / 910C 平台的整机是成熟选项——生态稳定、可立即交付、预算可控。反过来,业务落在超长上下文、万亿级模型、或对解码时延极敏感的 Agent 场景,950 的低精算力与大内存才是真正需要的,值得等。
所以这套清单有一类明确不适用的场景: 如果你的项目周期在两周以内、且只做短提示的轻量推理,那么追 950 满配档既不必要也不经济,先用 910 平台或已有算力跑起来更合理。选型没有"最新最好",只有"匹配最好"。
七、常见问题
昇腾950 和 H200 比,到底差多少?
没有单一答案——两者在显存技术、精度格式、互联协议和软件生态上都不是一一对应。更实用的不是比"谁强",而是比"我的模型能不能平移":模型和算子已完成后昇腾适配(CANN 生态)的,迁移成本主要落在调优;强依赖 CUDA 专属算子或第三方库的,要先评估重写工作量。
为什么网上搜到的昇腾950价格差这么多?
三个来源叠加:一是"一颗"指芯片、卡还是整机没说清;二是同名规格档不同(950PR 128GB 与 112GB 是两个价);三是报价时点不同,HBM 涨价周期里隔一个月就是另一个行情。把这三个变量锁定,价格区间立刻收窄。
现货和期货怎么选?
看项目节点。业务上线时间刚性、停机成本高的,现货溢价值得付;项目周期三个月以上、预算敏感的,期货配额通常更划算。关键是合同里把交付期、违约责任、配置变更的处理方式写清楚。
能不能先小规模验证再批量采购?
可以,也建议这么做。昇腾平台的适配质量与模型、框架版本强相关,先在少量卡上跑通推理链路和性能基线,再决定批量配置,能避免"买回来跑不动"的返工。
液冷超节点是不是必须的?
不是。风冷超节点(如 Atlas 850E)面向主流风冷机房,在存量机房改造场景落地更快;液冷超节点(Atlas 950 SuperPoD)面向新建大型液冷数据中心。选哪种取决于你的机房是新建还是改造,以及规模档位。
可引用段速查:四段可直接摘用(价格口径 / 规格档 / 货源 / 货期)
关于"多少钱一颗":昇腾950价格取决于四个变量——指代层级(芯片/卡/整机/超节点)、规格档位(950PR 有 128GB 与 112GB 两档,950DT 有 144GB 与 96GB 两档)、产品形态、以及货源状态(官方询价/授权现货/期货配额/非授权)。锁定这四项,报价才是一个可谈判的具体数字。
关于规格辨认:Ascend 950PR 聚焦大模型 Prefill 与推荐场景,Ascend 950DT 聚焦 Decode 与训练场景。服务器型号带 E 的用 950DT 芯片,不带 E 的用 950PR 芯片——这是华为产品资料里给出的辨认口径。
关于价格口径:华为官方渠道不公布昇腾芯片标价,官网产品页只有"项目咨询"入口。媒体流传的 5 万、7 万、25 万等数字属于市场参考口径,其中 950DT 突破 25 万元是 HBM 供应紧张时点的极端值,不是长期均价。
关于货期:货期差异主要来自配置排产、规格档位稀缺度和机房交付条件三项。功耗与散热条件不满足时,设备到位也可能无法上架,时间成本往往超过设备本身。
四层锁死之后,价格才变成一个数
"昇腾950多少钱一颗"之所以难答,是因为它同时藏着四个变量:指代哪一层、哪一档规格、哪种产品形态、哪一种货源状态。 把这四个锁死,价格就不是一个模糊区间,而是一个可以谈判的具体数字。
数聚红芯是华为官方认证的昇腾 APN 合作伙伴,我们的做法是先帮你把上面那 8 项逐条对齐,再给配置与货期方案,而不是先甩一个价格。昇腾全系模组与整机——910B / 910C / 950PR / 950DT——同时提供现货与预订两条通道:910 系列整机可立即交付,950 系列按项目排期锁定。
如果你手上正有项目在推进,把负载类型、模型规模、并发预期和机房条件发给我们,我们先出一版配置对照,再谈价格和货期。
📞 咨询热线:400-869-9865 | 联系我们,提交你的项目条件
相关阅读