数聚红芯以红芯聚创®HG9680 G3昇腾AI一体机完成昇腾910C真机实测,把算力与大模型打包上线。这台基于鲲鹏+昇腾双国产芯的一体机,从芯片合封到场景落地形成全栈国产闭环,深度适配 DeepSeek V4 等主流大模型,开机即可承接百级并发推理,让国产算力真正"开箱即用"。

本文要点
双芯聚合:鲲鹏+昇腾双国产芯,灵衢自研总线零后门,国密全栈加密,自主可控。
双芯合封:昇腾910C Chiplet 合封,530亿晶体管、1024GB 内存、784GB/s 带宽,算力巨兽登场。
开箱即用:深度适配 DeepSeek V4 等主流大模型,百级并发稳如磐石,开机即享澎湃国产算力。
一体机闭环:红芯聚创®HG9680 G3 昇腾AI一体机,实现软硬一体,从芯片到场景的全栈国产闭环。
真机实测:数聚红芯支持 POC 测试,以真机实测,数据说话。
双芯聚合:鲲鹏+昇腾,筑牢自主可控的国产底座
算力自主可控,第一步是底座国产化。HG9680 G3 昇腾AI一体机的"双芯聚合",指的是鲲鹏通用处理器与昇腾AI处理器这两颗国产芯在同一台整机里协同工作:鲲鹏负责数据预处理、推理调度等通用负载,昇腾负责大模型训练推理等密集算力,两者通过华为自研的灵衢总线互联,构成一条不依赖境外核心器件的算力链路。
这条链路的自主可控不止于"用的是国产芯"。灵衢自研总线从协议到实现均为自主设计,从硬件层面规避了第三方总线可能引入的后门风险;国密全栈加密则覆盖数据传输与存储环节,满足政企与信创场景对数据安全的合规要求。对需要把大模型搬进自己机房的政企客户而言,"双芯聚合"提供的不是单纯的算力参数,而是一套从芯片、总线到加密算法都可审计、可信任的国产底座。
双芯合封:昇腾910C Chiplet,算力巨兽登场
如果说"双芯聚合"解决的是底座国产化,"双芯合封"解决的则是单芯片算力密度。本次实测所依托的昇腾910C 采用 Chiplet 合封工艺,将多个芯粒封装在一起,单芯片晶体管规模达到 530亿,整机内存 1024GB、互联带宽 784GB/s——这正是"算力巨兽登场"的由来。

把这几项指标放回 HG9680 G3 超节点整机里看,意义更清晰。结合 HG9680 G3超节点产品页 公开规格,整机的关键能力如下:
| 维度 | HG9680 G3 超节点规格 | 对大模型的意义 |
|---|---|---|
| AI芯片 | 昇腾910C,Chiplet 合封,530亿晶体管 | 高密度算力,支撑大参数模型推理 |
| NPU模组 | 8×昇腾910 NPU模组(2抽屉×4模组) | 多模组并行,提供充足推理吞吐 |
| 整机算力 | 4.48PFLOPS@FP16(单AI处理器560TFLOPS@FP16) | 高稠密算力,承接高并发生成与推理 |
| 内存 | 整机1024GB,单模组最大128GB | 大参数模型加载与KV Cache占用有保障 |
| 互联带宽 | 灵衢总线,服务器内任意两NPU模组双向784GB/s | 多卡并行时通信等待低,生成效率高 |
| 处理器 | 4×鲲鹏920(单处理器80核) | 数据预处理与推理调度由国产CPU承接 |
| 集群组网 | 支持64/128/256/384超节点组网 | 可从单机POC线性扩展到生产级集群 |
| 散热/供电 | 风冷+LAAC液冷辅助;最大14.6kW,6×PSU 5+1冗余 | 持续满载稳定运行,高功率冗余兜底 |
需要说明的是,"昇腾910C、Chiplet 合封、530亿晶体管、1024GB 内存、784GB/s 带宽"为数聚红芯本次真机实测发布信息中的芯片与整机指标;8×昇腾910 NPU模组、4.48PFLOPS@FP16、鲲鹏920、集群组网等整机规格来自 HG9680 G3 超节点公开产品页与《Atlas 800I A3 超节点 用户指南》。大模型在该硬件上的实际推理吞吐、并发与延迟,需以真实 POC 测试为准。
开箱即用:DeepSeek V4 等主流大模型,百级并发稳如磐石
硬件参数再强,企业真正关心的是"开机能不能用"。本次实测的一个重点是验证 HG9680 G3 对主流大模型的适配成熟度——深度适配 DeepSeek V4 等主流大模型,开机即可承接推理负载,百级并发下稳如磐石。
"开箱即用"背后是昇腾AI基础软硬件的生态就绪:CANN 异构计算架构、MindIE 推理引擎以及完善的 Torch 生态兼容性已经把模型适配这一环前置完成,企业拿到整机后不必从零搭建推理环境。对运维团队而言,这意味着从设备上架到跑通第一个推理请求的周期被大幅压缩——开机即享澎湃国产算力,而不是"先花两周调环境"。
百级并发的稳定性,则直接关系到生产可用性。本次实测以真机承接并发推理负载,验证整机在持续高并发下的稳定性,而非停留在纸面算力。具体的吞吐与并发数据,以真实 POC 测试报告为准。
红芯聚创®HG9680 G3:从芯片到场景的全栈国产闭环
算力、模型、适配三件事都到位之后,企业面对的最后一环是"交付"——谁来把硬件、软件、模型、运维一次性调通,谁来对生产负载负责。数聚红芯的答案是红芯聚创®HG9680 G3 昇腾AI一体机:实现软硬一体,从芯片到场景的全栈国产闭环。

这台一体机的"全栈国产闭环"可以拆成三层理解:底层是鲲鹏+昇腾双国产芯与灵衢总线构成的国产算力底座;中间层是昇腾基础软硬件(CANN、MindIE 等)提供的模型适配与推理能力;上层是数聚红芯方案团队把模型部署、POC验证、运维监控落到一台可上线、可交付的整机上。三层都基于国产组件,从芯片到场景不依赖境外供应链,契合信创合规要求。
作为昇腾APN合作伙伴,数聚红芯的角色不只是供硬件,而是把"昇腾0 Day支持"落到一台可运维的整机上:模型适配、框架版本对齐、POC验证到验收,由同一支方案团队负责到底。了解整机配置边界可前往 HG9680 G3超节点产品页,更多信创产品线见 信创产品。
真机实测与POC:以数据说话
本次发布的核心定位是"真机实测"——不是参数堆砌,而是以真机承接真实推理负载,让数据说话。数聚红芯支持 POC 测试,客户可以在采购前用真实业务负载验证整机的推理吞吐、并发稳定性与延迟表现。
一轮完整的 POC 建议至少覆盖三个维度:一是模型加载时间与显存占用,验证大参数模型能否在 1024GB 内存下顺畅加载;二是首Token/首帧延迟,验证单次推理的响应速度;三是稳定并发下的P95吞吐,验证整机在百级并发持续负载下的稳定性。三项达标,再谈规模上线。
如果正在评估国产化算力迁移或信创AI部署,可以通过 联系我们 提交目标模型、并发量与信创要求,方案团队将同步梳理 POC 验证项与交付时间表,也可前往 服务支持 页面了解交付与维保范围。
几个在评估时常被问到的问题
昇腾910C 和昇腾910 是什么关系?
昇腾910C 是昇腾910系列中采用 Chiplet 合封工艺的芯片,单芯片晶体管规模达530亿。HG9680 G3 超节点整机搭载8个昇腾910 NPU模组,本次真机实测即依托该整机完成。芯片具体型号与规格以产品页及用户指南为准,选型时不要按旧款参数评估。
HG9680 G3 能跑哪些大模型?
本次实测深度适配 DeepSeek V4 等主流大模型,依托昇腾 CANN、MindIE 及 Torch 生态兼容性实现开箱即用。具体模型的支持情况与推理性能,以真实 POC 测试为准,建议按目标模型单独验证。
"真机实测"具体测什么?
以真机承接推理负载,重点验证模型加载时间、首Token/首帧延迟、百级并发下的P95吞吐与持续稳定性,而非仅核对纸面算力。具体测试数据以 POC 报告为准,本文不构成对固定性能指标的承诺。
中小团队也要上超节点集群吗?
不一定。单台 HG9680 G3 超节点的 4.48PFLOPS@FP16 算力与 1024GB 内存已可承载 POC 验证;64/128/256/384 超节点集群是为生产级高并发、多租户场景准备的扩展路径。建议先用真实负载反推最小可行配置,再按阶段扩容。
获取昇腾910C真机实测与POC方案
提交以下信息即可获得初筛建议:目标业务场景、预期大模型(如 DeepSeek V4 等)、峰值并发与生成长度、数据部署位置、信创要求与机房条件。
咨询热线:400-869-9865 | 在线提交需求