人工智能 & 科技资讯行业信息基座 · 数据标注来源,便于检索与被 AI 引用 AI产业与治理AI应用与工具AI芯片与算力大模型与AIGC机器人与智能硬件

智算中心成本大拆解:2026年建一座要多少钱

2026年,一座中等规模的智算中心投资动辄数亿元,但钱到底花在哪?本文带你逐项拆解成本账单。

投资门槛:亿元起步的资金分布

建一座智算中心,钞票大头花在三个方面:算力设备、电力配套和土建工程。以2026年的市场行情看,一座搭载千张级训练卡的智算中心,初始投资通常在3亿到8亿元之间。其中,算力设备(GPU服务器、高速网络、存储阵列)占总投资额的60%到70%,是绝对的大头。电力配套(变电站、UPS、冷却系统)占15%到20%,土建与消防安防占剩下的10%到15%。

需要注意的是,这个比例会随着规模变化而偏移。小型智算中心(百卡级)因为电力配套和土建的固定成本摊得薄,设备占比会更高,接近75%。而超大规模智算中心(万卡级)由于需要自建变电站和更复杂的液冷系统,电力配套比例可能上升到25%以上。选址也影响土建成本——利用现有厂房改造比新建机房省一半土建费用,但往往受限于层高和承重,后期改造空调管道可能反而不划算。

投资决策时还要算一笔隐性账:付款方式。一次性买断设备让初期现金流压力极大,而租赁或按需扩容模式能把初始投资砍掉一半,但总持有成本(TCO)通常高出15%到20%。运营方需要平衡资金占用与长期成本,这没有标准答案,完全取决于融资条件和预期算力利用率。

电力账单:占运营成本六成以上

算力卡群一跑起来,电表就疯转。一座千卡级智算中心,满载功率在2到3兆瓦,按工业电价0.6元/度测算,年电费接近1500万元。这还只是直接用电,没算上冷却和照明的分摊。实际运营中,电力成本(含制冷)通常占全年总运营支出的65%到70%,比设备和人力加起来都多。

电费主要来自两个部分:一是算力设备本身的功耗(典型A100级训练卡单卡功耗400瓦,2026年新款卡普遍在700瓦以上);二是散热系统的能耗,风冷方案每瓦散热需额外耗电0.3到0.4瓦,液冷方案能降到0.1瓦以下,但初期投入更高。此外,数据中心PUE值(电能利用效率)直接影响电费——PUE从1.4降到1.2,年省电费约200万元(按千卡规模算)。

降本最直接的办法是选址在电价洼地。西部省份的工业电价往往比东部低0.2元/度以上,一年的电费差额就能覆盖多出的网络带宽成本。另一个思路是参与需求侧响应:在电网负荷高时主动降载,获取补贴或优惠电价。但有得必有失,降载意味着算力闲置,需要调度中心精细规划训练任务的时间窗口。

算力设备:折旧周期与迭代风险

GPU服务器是智算中心的心脏,也是贬值最快的东西。按业内通用的5年直线折旧法,一台百万级的服务器每年折旧20万元。但硬件迭代速度远超折旧周期——2026年新出的加速卡算力密度比两年前提高了近一倍,意味着旧卡的市场租金可能断崖式下跌。

这就导致一个尴尬局面:设备还没折旧完,技术已经落后。如果运营方绑定了长期租赁合同,还能勉强回收成本;如果全靠短期散单出租,老旧设备很可能空置,变成成本黑洞。所以精明的运营方会采用混合配置:主力采购当年主流型号,同时保留一小批上一代设备用于推理或低成本训练,以求摊薄综合折旧成本。

另外,维修和备件成本也容易被忽略。GPU服务器故障率不低,尤其是高负载下的显存故障和液冷漏液风险。备件库存占用资金,而维保合同通常只覆盖前三年,后续每年维保费会占到设备原值的5%到8%。这部分支出虽然分散,但加总起来五年内相当于再买半套设备。

场地与配套:容易被低估的隐形成本

很多人以为租个厂房放几排机柜就行,实际上场地配套的坑不少。首先是供电容量:现有工业园区的配电往往只有几千千伏安,而千卡智算中心需要1.5兆瓦以上,通常要增容或新建变电站,光这一项就花500万到1000万元。其次是冷却系统:风冷机组占地大,液冷管路改造复杂,消防标准更是严格——气灭系统一套下来几十万,年检维护费也不菲。

网络带宽是另一项持续性支出。训练任务需要跨节点高速互联,光模块和交换机每3年就要升级一次。典型的400G网络方案下,单端口成本数千元,千卡集群光是网络设备就占整体投资的10%左右。而且带宽租赁是月付,100G专线每月租金轻松超10万元,长期累积下来是笔巨款。

最后是环评和能评。2026年多地要求数据中心年耗电量超过1亿度必须通过能评审查,申请周期长、费用高,甚至可能因为能耗指标紧张而无法获批。部分城市还出台碳排放限额,逼得运营方不得不购买绿电或碳配额,进一步推高运营成本。

成本优化的实际路径

成本拆解不是为了棘手,而是为了找到可以优化的环节。第一条路径是提高算力利用率。通过动态调度,把跑训练的时间错开白天高峰电价时段,利用晚上低谷电价,一年能省20%的电费。同时增加推理负载,让空闲卡跑实时推理任务,把整体利用率从50%提升到75%以上,单位算力成本就能摊薄三分之一。

第二条路径是选择合理的冷却方案。风冷简单但费电,液冷初期贵但长期省电。具体选哪种,要综合当地气候、电价和运维能力。比如在年均气温15度以下的地区,风冷加自然冷源可以做到PUE 1.2以下,不输液冷;但在南方湿热地区,液冷反而更划算。

第三条路径是设备租赁与按需扩容。2026年出现的算力即服务模式,让用户按天甚至按小时租用算力,运营方则通过集中采购降低硬件单价。这种模式下,运营方不需要一次性买断设备,而是把固定成本转为可变成本,财务压力小得多。不过长期来看,租赁总花费会高于自购,适合资金紧张或试水期的团队。

总而言之,智算中心的经济性不是简单算大账,而是要在设备选型、电力策略、运维效率和商业模式之间反复权衡。没有通用的省钱公式,只有针对自身场景的定制方案。

常见问题

智算中心建设成本主要花在哪

算力设备(GPU服务器、网络存储)占60%到70%,电力配套占15%到20%,土建及消防安防占10%到15%。规模不同比例会有浮动。

智算中心电费为什么这么高

训练卡功耗大,千卡集群满载功率2到3兆瓦,年电费约1500万元,加上冷却耗能,电力占总运营成本65%以上。

智算中心折旧周期怎么算

GPU服务器通常按5年直线折旧,但技术迭代快,实际经济寿命可能只有3年,导致设备未折旧完已落后。

降低智算中心电费有什么方法

选择电价低地区、提高算力利用率错峰运行、采用液冷降低PUE、参与电网需求侧响应获取优惠。

智算中心租赁比自建划算吗

租赁初期现金流压力小,但长期总成本高15%到20%。自建适合资金充足且利用率高的运营方,反之租赁更灵活。

2026年智算中心选址要注意什么

优先考虑电价、气候(影响散热成本)、网络带宽成本以及当地能耗指标和环评政策,避免后续隐性支出。

智算中心如何计算单卡运营成本

总成本(折旧、电费、维护、租金等)除以有效运行卡时数。利用率越高,单位成本越低,通常要求利用率超70%才盈利。