AI训练和推理

专业AI解决方案,实现AI高效办公

金融高频交易

融合解决方案,建筑高频交易算力基座

设计和仿真

解决不同计算场景,不同数据形态的设计渲染、仿真问题

高性能计算

提供高性能、高算力集群方案

存储

解决I/O性能读写瓶颈,高可靠数据安全

数据中心和云计算

从整机柜到数据中心,提供全面的液冷解决方案

通用服务器

解决不同计算场景,不同数据形态的设计模拟问题

液冷产品

解决不同计算场景,不同数据形态的设计模拟问题

软件

解决不同计算场景,不同数据形态的设计模拟问题

昇腾AI一体机零机房改造部署:HG9680 G3风冷直上方案解析

分类:企业动态

发布时间:2026年08月18日

作者:Linkupail MKT

企业决定上国产大模型算力,预算批了、模型选好了,最后卡在机房这一关——这件事比想象中更普遍。

液冷管路要铺设到机柜位,配电容量要从楼层配电箱开始扩,机柜承重不达标要加固楼板。每一项改造都要真金白银,更要紧的是时间。改造周期动辄数周,等机房就绪,业务窗口早过去了。有的项目卡在这里一拖就是一个季度,技术团队眼睁睁看着竞品用上了新能力,自己还在等施工队进场。

这中间的问题不在于国产算力本身够不够用,而在于传统高功率AI服务器对机房基础设施的要求太重。有没有一条路可以绕过机房改造,直接上架干活?红芯聚创®HG9680 G3昇腾AI一体机给出的方案是:风冷散热、标准机柜落位、插电即开机,把算力上线从"按月计算"压缩到"按小时计算"。

本文要点
机房改造三道门槛:液冷管路铺设、配电扩容、机柜承重加固,周期动辄数周,是国产算力落地的头号时间杀手。
零改造直上的前提:风冷散热方案不依赖机房液冷管路,标准机柜尺寸直接落位,现有配电即可承接。
开机即有算力:鲲鹏+昇腾双国产芯,全栈国产适配,DeepSeek-V4-Pro正式版等主流大模型开箱即用,到货即可跑通推理。
交付全程兜底:整机一站式交付,三年原厂质保,全国2600+服务网点,从下单到投产由同一支团队负责。

上国产算力,为什么卡在机房这一关

先看一组真实场景。

一家做政务文档智能的企业,去年底定了用昇腾路线部署大模型推理服务。芯片选型、模型适配方案都确认了,到装机阶段才发现:目标机房的供电是三年前按通用服务器标准配的,单路不到10kW,带不动高功率AI服务器。要扩容,得从楼层配电柜改起,涉及物业审批、施工排期、停机窗口协调,最快也要六周。

另一家做医疗影像分析的企业,机房在写字楼十二层。高功率服务器上了液冷方案,室外冷源没地方放,管路走不了吊顶。最后只能租用楼下商业机房的柜位,额外增加了一条跨楼层的光纤和运维通道,月成本多了将近两万。

这两个场景的共同点是:算力和模型都准备好了,卡在的是物理基础设施。具体来说,传统高功率AI服务器进机房,通常要过三道门槛。

第一道,液冷管路。 高功率AI服务器(单机14kW以上)风冷压不住满载温度,需要液冷方案。而液冷不是"把管子接上"这么简单——冷源放置、管路走向、防漏检测、应急断流,每一项都要在机房装修阶段预留。已经建成的通用机房几乎没有这些预留,改造成本和周期都不小。

第二道,配电扩容。 通用机房的标准配电通常按单机柜5-8kW设计,而高功率AI服务器单机功率动辄十几千瓦。要支撑这样的负载,需要从楼层配电柜、PDU到末端插座全链路扩容,涉及电缆敷设、断路器更换、负载平衡校验。如果楼宇总容量不够,还得协调供电局增容,周期可能拉到一两个月。

第三道,机柜承重。 高密度AI服务器满配后重量可观,普通机柜和楼板未必扛得住。加固机柜需要更换承重柜或加装支撑件,加固楼板则涉及结构评估和施工审批,周期和成本都不确定。

三道门槛叠加,改造周期短则两三周,长则一两个月。这还不算停机协调、物业审批、施工排期这些非技术因素。很多企业的AI项目不是死在技术方案上,而是死在等机房改造的这段时间里。

零改造直接上架:风冷方案如何绕过三道门槛

问题的解法不在于"怎么更快地改造机房",而在于"能不能不改机房"。

红芯聚创®HG9680 G3昇腾AI一体机走的就是这条路线。这台机器的散热方案以风冷为主,不需要在机房铺设液冷管路;整机尺寸适配标准19英寸机柜,直接落位不需要更换承重柜;功耗控制在通用机房配电可承接的范围内,不需要从楼层配电开始扩容。

三道门槛逐一拆开看:

门槛传统高功率AI服务器HG9680 G3 风冷方案
液冷管路需铺设液冷管路、配置冷源、防漏检测风冷散热为主,不依赖机房液冷基础设施
配电扩容单机14kW+,常需楼层配电全链路扩容功耗适配通用机房配电标准,现有供电可承接
机柜承重满配重量大,可能需加固柜或楼板标准机柜落位,直接上架无需加固

结果是把算力上线周期从"等机房改造完成"压缩到"设备到货即上架"。不需要等施工队进场,不需要协调物业审批,不需要停机窗口。设备到货,推入机柜,接电开机,算力就位。

鲲鹏+昇腾双国产芯:开机即有的算力底座

零改造上架解决的是"能不能放进机房",接下来要解决的是"放进去之后能不能用"。

HG9680 G3昇腾AI一体机的算力底座是鲲鹏+昇腾双国产芯。鲲鹏920通用处理器负责数据预处理与推理调度,昇腾910C AI处理器负责大模型训练与推理的密集算力。两颗国产芯在同一台整机内协同工作,从芯片到整机不依赖境外核心器件,契合信创合规要求。

结合 HG9680 G3超节点产品页 公开规格,整机关键能力如下:

维度HG9680 G3 规格对部署的意义
AI芯片昇腾910C,Chiplet合封高密度算力,支撑大参数模型推理
整机算力4.48PFLOPS@FP16高稠密算力,承接高并发生成与推理
内存整机1024GB大参数模型加载与KV Cache有保障
互联带宽灵衢总线,784GB/s多卡并行通信等待低,生成效率高
通用处理器鲲鹏920(80核)数据预处理与调度由国产CPU承接
散热方案风冷为主,LAAC辅助无需机房铺设液冷管路
交付形态整机一站式交付到货即上架,开机即用

需要说明的是,上述规格来自HG9680 G3超节点公开产品页与数聚红芯发布信息。大模型在该硬件上的实际推理吞吐、并发与延迟,需以真实POC测试为准。了解完整配置边界可前往 HG9680 G3超节点产品页

大模型开箱即用:从到货到出结果的一天

硬件就位只是第一步,企业真正关心的是"开机能不能跑通模型"。

传统国产算力部署的一个常见痛点是模型适配周期长。两年前在昇腾上跑PyTorch模型,需要大量手工算子适配,工程团队试一轮就可能放弃。现在的生态成熟度已经不同——CANN异构计算架构、MindIE推理引擎以及Torch生态兼容性已经把模型适配这一环前置完成。

HG9680 G3在这一基础上更进一步:DeepSeek-V4-Pro正式版、Qwen、Kimi、MiniMax、GLM等主流大模型开箱即用,不需要企业从零搭建推理环境。设备开机,模型加载,推理请求发出去就能收到响应。对运维团队来说,从设备上架到跑通第一个推理请求的周期被压缩到小时级——今天到货,明天出结果。

这意味着企业可以把精力集中在业务验证上,而不是消耗在环境搭建和算子调试上。模型的实际推理性能,建议通过POC测试用真实负载验证。

整机一站式交付:从下单到投产全程有人管

零改造上架、开机即用之后,企业面对的最后一环是交付保障——硬件到货后谁来装机调试,出了问题谁来响应,质保期内怎么修。

数聚红芯的交付框架可以拆成几个阶段:

阶段数聚红芯交付内容客户侧需要做的事
售前方案需求确认、机型推荐、机房勘测、方案设计提供业务场景与机房现状
交付部署整机到货、机柜上架、系统调试、模型加载协调机柜位与供电接入
POC验证真实负载测试、推理吞吐验证、并发稳定性验证提供测试模型与业务数据
验收投产性能达标确认、运维交接、上线投产验收确认
售后保障三年原厂质保、全国2600+服务网点响应按需报修

整机一站式交付的核心价值在于:从售前方案到售后保障,由同一支团队负责,不需要企业在硬件厂商、集成商、运维服务商之间做衔接。三年原厂质保覆盖整机硬件,全国2600+服务网点提供属地化响应。

更多信创产品线见 信创产品

选型建议:什么场景适合零改造直上方案

零改造直上方案不是所有场景的最优解。在判断HG9680 G3是否适合自己的情况之前,建议先确认几个前提。

适合的场景。 机房已建成、配电按通用标准设计(单路5-8kW)、没有液冷基础设施、需要在短时间内上线国产算力、目标负载以大模型推理为主。典型如政企信创项目、企业私有化大模型部署、行业模型推理服务。

需要评估的场景。 如果业务以大规模训练为主、需要多机集群组网、机房空间紧张或配电余量接近极限,建议先做一轮机房勘测和POC测试,确认单机功耗与散热在目标机房环境下的表现。HG9680 G3支持64/128/256/384超节点组网,大规模训练场景可从单机POC线性扩展到集群部署,但集群部署阶段的机房基础设施需求需要单独评估。

一个实操建议。 如果正在评估国产化算力迁移或信创AI部署,可以先通过 联系我们 预约一轮机房勘测和POC测试。用真实业务负载验证推理吞吐和并发稳定性,再决定是否进入规模部署。这比读完参数表直接下单更稳妥。

常见问题

Q:零改造直上是不是意味着性能打折扣?

风冷方案解决的是机房基础设施门槛,不影响芯片本身的算力输出。昇腾910C的算力指标在风冷散热条件下可以正常发挥。但持续满载工况下的温度表现和长期稳定性,建议通过POC测试验证。

Q:现有机房配电5kW/柜,能带得动吗?

HG9680 G3的功耗设计适配通用机房配电标准。具体是否需要调整配电,取决于目标机柜位的现有供电余量。建议在售前方案阶段安排机房勘测,确认供电、空间、散热条件。

Q:模型适配要多久?

DeepSeek-V4-Pro正式版等主流大模型已预适配,开机即可加载推理。如果业务使用的是定制模型或需要特定算子优化,适配周期取决于模型复杂度,数聚红芯方案团队可提供技术支持。

Q:和HI5228昇腾AI一体机有什么区别?

HG9680 G3基于昇腾910C,算力密度更高,适合大参数模型推理和高并发场景。HI5228定位为昇腾AI一体机入门方案,适合中小规模推理部署。两者同属数聚红芯信创产品线,可根据业务规模和预算选择。了解HI5228详情见 信创产品

Q:POC测试怎么申请?

通过 联系我们 提交业务场景和测试需求,数聚红芯方案团队会协调设备资源和测试环境。一轮完整的POC建议覆盖模型加载时间、首Token延迟、稳定并发P95吞吐三个维度。


lizixuabal1.jpg

专注于智能计算解决方案

专业的顾问服务

耐心的答疑解惑

全国统一服务热线:400-869-9865

邮箱:business@linkupai.cn

立即咨询

我们欢迎任何人联系我们,请描述您的问题,我们的团队将在3个工作日内与您取得联系。或拨打我们的热线 400-869-9865 立即咨询。

*

*

*

我们承诺收集您的这些信息仅用于与您取得联系,帮助您更好的了解我们的合作计划。
发送即代表您同意我们的《隐私政策》

lizixuabal1.jpg

专注于智能计算解决方案

专业的顾问服务

耐心的答疑解惑

全国统一服务热线:400-869-9865

邮箱:business@linkupai.cn

立即咨询

我们欢迎任何人联系我们,请描述您的问题,我们的团队将在3个工作日内与您取得联系。或拨打我们的热线 400-869-9865 立即咨询。

*

*

*

我们承诺收集您的这些信息仅用于与您取得联系,帮助您更好的了解我们的合作计划。
发送即代表您同意我们的《隐私政策》

咨询

客服

13352692294

微信