"服务器用几年该换?"——这个问题在评审会上一问出来,通常就已经问偏了。年限只是账面口径,而账面口径有三套、用途还各不相同。真正决定什么时候换的,是三类可观测的信号。下面按决策会上必须回答的四个问题依次拆开,答完就知道你现在该做什么。
一、第一问:到底几年该换?先分清三套口径
关于"几年",公开信息里至少并存三个数字。它们都对,但用途完全不同,互相替代会出错。
| 口径 | 年限 | 用途 | 误用后果 |
|---|---|---|---|
| 税法最低年限 | 3 年(电子设备) | 企业所得税税前扣除的最低标准 | 把它当成"技术寿命",会过早触发换代 |
| 会计实务常用 | 5 年 | 企业计提折旧、账面成本分摊 | 把它当成"必须用完",会拖过技术窗口 |
| 海外云厂商公开口径 | 5–6 年 | 同业对照参考 | 拿海外财报口径直接套国内准则,不成立 |
税法那一栏的依据是《中华人民共和国企业所得税法实施条例》第六十条,电子设备的最低折旧年限为 3 年——注意"最低"两个字,它是税务处理的底线,不是技术判断的标准。会计上常用 5 年,讲的是成本怎么摊。而海外云厂商近两年把服务器折旧年限定在 5–6 年、并因此被公开讨论过,那是财报口径,跟你的采购决策不是一回事。
所以第一问的正确答案是:这个问题不该问"几年",该问"哪些信号先出现"。 年限只影响一件事——折旧摊完之后,换代的账面阻力会小很多。它是决策的助力,不是决策的依据。

二、第二问:现在是不是该换了?看三个信号
把"几年"换成可观测的东西,判断就落到具体操作上了。以下三类信号,任何一类先出现,就该进入换代决策。
信号一:显存撞墙。 目标模型的权重加 KV Cache 已经超出你现有卡的单卡容量,只能靠调低量化精度或压缩并发来硬撑。观测方法很直接:记录目标模型的参数量、KV Cache 随上下文长度的增长、以及你当前允许的最大并发——当"想跑的配置"开始需要牺牲并发来换时,撞墙已经发生了。这一条的详细算账方式,本系列前面的文章里给过口径。
信号二:互联瓶颈。 多机扩展时受卡间或机间带宽限制,加卡之后吞吐不线性增长,利用率反而下降。观测方法:对比单机与多机的实际吞吐,算一下扩展效率(多机吞吐 ÷ 单机吞吐 ÷ 机器数)。如果这个数明显低于预期,说明瓶颈已经从算力转移到了互联。
信号三:精度格式缺口。 新模型需要的低精度格式在你现有平台上不被原生支持,只能靠软件模拟或退回高精度。这一条最难靠观测发现,因为它表现为"能跑,但成本比预期高"。观测方法:核对目标模型所依赖的数值格式,与现有平台支持清单逐项比对。
这三个信号有一个共同点:它们都发生在"跑不动"之前,表现为"跑得比预期贵"。 等到真正跑不动才换,通常已经晚了半年。
三、第三问:换成什么?官方自己给过一次代际账
换代要回答"多拿到什么",最好用官方口径而不是第三方参数表。华为在 2025 年全联接大会上由轮值董事长徐直军介绍昇腾芯片路标时,对 950 与上一代的差异给了一组明确表述,其中有一条是直接与 Ascend 910C 对比的:
互联带宽相比 Ascend 910C 提升 2.5 倍,达到 2TB/s;
新增支持业界标准的 FP8 / MXFP8 / MXFP4,算力分别达到 1P(FP8、MXFP8、HiF8)与 2P(MXFP4);
内存访问颗粒度从 512 字节减少到 128 字节,更好地支持离散且不连续的内存访问;
Ascend 950PR 与 Ascend 950DT 共用 Ascend 950 Die,由自研的 HiBL 1.0 与 HiZQ 2.0 两种 HBM 分别合封构成,前者面向 Prefill 与推荐,后者面向 Decode 与训练。
同一场演讲里还有一句值得记住的话:"2025 年,Ascend 910C 芯片随着 Atlas 900 超节点规模部署"——也就是说,910C 这一代是以超节点形态规模落地的,它并不是一个孤立的卡,而是一套已经在跑的系统。
这三条里,对换代决策最有价值的其实是第一条和第三条。 带宽提升 2.5 倍直接对应"信号二:互联瓶颈",内存访问颗粒度从 512 字节降到 128 字节则直接影响离散访存类算子的实际效率——这两项都不是"峰值更高",而是"原来卡住的地方不卡了"。 对已经撞过墙的项目,这类改进比峰值数字更能解决问题。
四、第四问:老的机器怎么办?三种并存方式
这是最容易在评审会上被跳过、又最容易在实施时出问题的一问。三种方式各有前提:
| 方式 | 做法 | 适用条件 | 主要代价 |
|---|---|---|---|
| 同构扩容 | 继续采购现有平台,把规模做上去 | 现有平台仍满足负载,瓶颈在数量而非代际 | 受限于老平台的能力上限,可能提前再换一次 |
| 新旧混部 | 新老平台并存,按负载分派任务 | 老平台能承接一部分稳定负载,且软件栈支持异构调度 | 需要运维能力,调度与版本配套是难点 |
| 整体替换 | 老平台退役,新平台承接全部负载 | 老平台已无承接价值,或机房/电力已到边界 | 一次性投入最大,业务切换窗口风险集中 |
新旧混部不是"折中方案",它是有技术前提的。 昇腾官方的开源项目 MindIE-PyMotor 就提供了"一键式 PD 分离与 PD 混部部署",并分别给出部署文档——这说明混部在昇腾生态里是一条被官方支持的路径,而不是将就。但要注意:官方支持的是能力,不是你的可行性。 你的模型版本、框架版本、调度系统是否跟得上,要单独验证。
一个务实的判断顺序:先看老平台还能承接哪些负载(通常是对代际不敏感的推理与批处理),再算清这部分占总量多少,剩下的才是需要新平台承接的部分。先分类,再决定买多少——而不是先决定买多少,再想办法把老的用起来。
五、把四问收成一张决策顺序表
四个问题答完,动作顺序自然就出来了:
| 顺序 | 要回答的 | 产出物 |
|---|---|---|
| 1 | 现在有没有触发信号? | 三个信号的观测记录(显存余量、扩展效率、格式比对) |
| 2 | 老平台还能承接什么? | 按代际敏感度分类后的负载清单 |
| 3 | 新平台要接多少? | 需要新增的规模区间,而不是一个精确数字 |
| 4 | 用什么方式过渡? | 同构扩容 / 混部 / 整体替换三选一,含切换窗口安排 |

注意第一步和第二步是可逆的、低成本的;第三步和第四步才涉及采购。 很多项目的顺序是反的——先定了采购量,再回头论证必要性。把这两步拆开、把便宜的先做完,是本篇最想传递的一个动作。
六、关于换代,几个常见问题
服务器一定要用满折旧年限才能换吗?
不必。折旧年限管的是账面成本怎么摊,不是能不能换。提前换代在会计上是可以处理的(处置固定资产),只是会影响当期损益。真正的约束通常来自预算周期和内部审批,不是会计规则。
910C 会被停产吗?现在买是不是接盘?
目前没有看到华为官方发布停产公告,910C 仍是官网在售平台(Atlas 800I A3 / 800I A2 / 800T A2 等机型均在列)。"会不会停产"和"该不该买"是两个问题:如果负载对代际不敏感、交付节点又紧,现货平台的可用性是实打实的优势;如果需要低精度格式或更大互联规模,那 950 才是对症的。
新一代出来了,老平台是不是马上就不好用?
不会。技术代际切换在工程上是渐进的。真正的切换点不是新品发布日,而是你的软件栈开始只支持新平台的那一天。 这也是为什么第三节里"精度格式缺口"被列为信号之一。
没有触发信号,但预算年底要花掉,该买吗?
这类决策要先想清楚一件事:买来的算力如果接不上真实负载,占用的是机位、电力和运维人力。如果确实要花,优先补短板(存储、网络、机房条件)通常比补卡更划算。
小规模项目也要走这四问吗?
要,但可以压缩。前两问是免费的——把显存余量和扩展效率记下来、把负载按代际敏感度分个类,半天就能做完。真正需要按规模递增的只有后两问。
把四个问题收回来
回到开头:"服务器用几年该换?"
正确的答案是一条顺序:先确认三套年限口径各管什么(它们不回答该不该换),再去看三个信号有没有出现(这才回答该不该换),然后算清新平台的代际收益,最后决定新老怎么并存。 年限是账面的事,信号才是工程的事。
数聚红芯是华为官方认证的昇腾 APN 合作伙伴。昇腾全系模组整机 910B / 910C / 950PR / 950DT 均有现货库存、支持预订下单,一手资源与价格——910 平台可立即交付,950 平台按项目排期锁定。如果你正在做年度算力规划,可以把现有平台型号、目标模型、当前并发与显存余量发过来,我们先帮你把三个信号过一遍,再给配置与货期方案。
📞 咨询热线:400-869-9865 | 联系我们,提交你的项目条件
同系列相关阅读