智算中心“满载”与“闲置”并存冷热不均倒逼机制重构
智算中心“满载”与“闲置”并存 冷热不均倒逼机制重构
尹靖霏
9月上旬, 中国银行 宣布,“十五五”时期将联合多类算力生态伙伴,共建“算力+”产业金融生态,提供不少于3000亿元 综合 金融支持,覆盖100个重点智算中心项目。此前,国家发展改革委表示,据机构测算,“十五五”时期算力网建设将新增直接投资4万亿元。
资金加速涌入之际,算力基础设施建设正驶入快车道。但证券时报记者多方调研发现,火热行情之下,全国算力中心正呈现“冰火两重天”的结构性失衡:一边是高端智算资源集体供不应求,一批运营主体依托差异化定位和技术积累跑出正向循环;另一边则是低端算力大量闲置,在芯片代际、运营主体、区域分布上呈现多重分化。
值得关注的是,与上一轮“重硬件、轻运营”的粗放扩张不同,新一轮算网建设已建立风控闭环,通过“带订单批项目+第三方专业运营”模式,从审批源头遏制新增闲置,通过市场化运营激活存量资产,让万亿级算力基建资金实现精准落地。
高端算力供不应求
高端算力的紧俏程度远 超市 场预期,不同运营主体依托差异化的定位和技术积累,普遍跑出了正向循环的运营曲线。
配置高端芯片的智算集群持续供不应求, 并行科技 副总裁赵鸿冰向证券时报记者介绍,其位于内蒙古的智算集群依托当地低电价、自然冷源的区位优势,已实现饱和运营,下游覆盖大模型训推、各类AI智能应用全场景客户。
主打中小客户定制化服务的第三方算力服务商也进入盈利上行通道。优刻得相关负责人向记者透露,公司2025年第四季度就已实现扭亏为盈,2026年第一、第二季度连续保持盈利,其布局在乌兰察布和上海青浦的两座智算中心总算力规模超万PFLOPS(每秒千万亿次浮点运算),同时支持国内外多品牌多类型算力芯片灵活部署,主要对接中小客户碎片化的算力需求,目前业务亦是“一柜难求”。
国内运营商体系的智算中心也在加速落地国产算力。长三角某运营商旗下智算中心运维人员向记者证实,其建成的一期算力中心已直接采购 华为升腾 、阿里平头哥等国产算力芯片,目前正在对接下游客户。
以 华为升腾 为代表的国产算力生态正在产业界渐次落地。深澜智算(深圳)技术有限公司创始人岳诗鹏告诉记者,此前陕西某国企算力项目落地初期,自有运维团队对升腾底层算法库和推理服务框架熟悉度不足,集群上线后算力利用率一度处于较低水平,后续项目引入 华为升腾 技术团队驻场提供全链路定制化深度调优后,集群整体算力利用率攀升至80%—90%的高位,满足生产级业务负载要求。
类似案例正在增多:DeepSeek今年4月发布的V4大模型全栈基于升腾生态完成训练,其乌兰察布自建万卡级集群主要采用升腾方案。
利用率冷热不均
高端算力供不应求的另一面,是全行业算力利用率冷热不均问题突出。
中国信息 通信 研究院数据显示,2025年我国智能算力供应量约38亿卡时,同期实际使用量仅14亿卡时,算力实际使用率约36.8%,超六成建成算力处于闲置状态。另据浪潮 人工智能 研究院2026年一季度监测数据,全国智算中心GPU平均利用率约30%。
记者调研发现,算力空置并非源于行业整体性过剩,而是结构性失衡,在运营主体、集群规模、芯片代际等维度上呈现冷热不均的状态。
从运营主体维度看,岳诗鹏告诉记者,头部互联网厂商自建算力集群供不应求,依托内部模型训练和对外推理服务实现满负荷运转;三大运营商算力平台依托自有业务与 信创 订单托底,空置率可控;地方城投、国资平台投建的智算中心,则存在广泛空置情况。
从集群规模看,某 电子 信息研究院研究员宋晓(化名)向记者介绍,千卡级小型算力集群空转问题突出,因算力规模无法达到大模型训练所需的万卡级门槛,难以承接头部厂商核心订单。
不同芯片品类之间,算力闲置分化现象明显。某第三方算力调优公司负责人李观澜(化名)观察到,当前算力闲置主要集中在老旧算力卡,老款国产卡显存普遍仅64GB,无法适配大模型参数迭代需求;2026年上市的新一代国产算力卡标配显存提升至144GB,算力资源利用率飙升。
词元开物CEO张乃干告诉记者,不同芯片梯队市场表现两极分化: 英伟达 、华为升腾芯片的算力集群,整体供不应求,算力一旦释放一周内即被抢订;排名第5位至第30位的国产中小厂商芯片,算力卡上架后难有真实商用负载。
地方国资新建算力项目同样面临闲置压力。 数据中心 硬件行业专家王慧平分析,头部先进 国产芯片 被互联网大厂垄断,地方国资项目只能采购中低端算力芯片,项目难以实现稳定消纳。
空置多重成因拆解
空置分化并非偶然,其背后是决策偏差、生态短板与跨区域调度约束的逐层传导。
其一,“先建再用”埋下包袱,国资平台缺运营,老卡先天不足。
部分地方国资智算中心出现空置,内因之一在于历史选型与后续需求之间存在错配。宋晓告诉记者,大量闲置产能形成于算力建设抢跑期,当时各地为冲建设规模,较多采用“先建设、后找需求”的模式,对芯片商用适配性的校验不足,也未充分对接下游订单,最终形成无效资产。某科研机构算力研究员杨清(化名)称,部分欠发达地区为落实国产化指标,存在盲目采购不成熟低端 国产芯片 的现象。
岳诗鹏进一步分析国资算力平台运营痛点:一是无自有业务托底,沿用地产开发思维建设算力中心,缺乏稳定收入来源;二是获客、算力调度等运营能力普遍薄弱,难以满足商用算力SLA(服务等级协议)高可用标准;三是采购导向偏向 信创 属性,头部 国产芯片 供给紧张,不得不优先选用市场认可度低的小众芯片;四是算力集群规模多是千卡级别,只能承接零散小订单,营收稳定性不足。
其二,国产GPU生态存在结构性难题,算力释放受限于软件栈适配不足。
硬件层面,岳诗鹏指出,大量中小厂商的国产算力卡实际性能未达宣传指标。李观澜说,不同代际算力卡标称参数差距不大,但实际商用表现远不及纸面参数,大量纸面算力因软件栈适配不足,无法转化为有效生产力。
软件层面,国产芯片缺乏完善的底层软件栈与算子库,迁移适配成本高、难度大,造成硬件部署完成后较难高效商用。李观澜指出,当前不同厂商纷纷推出算力调优工具,试图解决这一难题,但目前多数未实现底层技术突破。
更深层的问题,在于行业评价与采购机制的症结。张乃干表示,国内近20家国产GPU厂商缺乏公开、权威的第三方评测体系,市场鱼龙混杂。部分GPU企业依靠地方国资订单做大规模宣传、冲刺资本市场,而非打磨产品性能。他预判,老款国产算力卡贬值速度快,2026年前采购的非头部算力卡或难以实现投资回本。
此外,跨区域算力调度存在现实瓶颈。宋晓解释,大模型训练数据体量庞大,东西部跨网传输耗时久、时延高、带宽成本高,部分市场化付费算力需求难以转移至西部。同时,部分算力中心功能同质化严重,无法挖掘细分场景算力需求,进一步固化闲置问题。
跳出算力闲置旧循环
国家数据局披露,截至今年6月,全国在用智算中心超过500个,在建及规划项目近400个。当前算力网作为国家“六张网”新型基础设施的核心抓手,新一阶段万亿级智算建设周期正式启动。证券时报记者获悉,当前从顶层审批规则到市场化产业服务已经形成较完整的风险防控闭环,有能力跳出过去的空置怪圈。
目前,地方国资智算项目已设立审批红线。某省级地方政府人士告诉记者,地方智算项目中,凡财力无法覆盖长期投入的,一律不予审批,区县层级盲目跟风建算力的现象已杜绝。
同时,某地方政府招商平台负责人告诉记者,多地正引导智算中心建设向集约化方向发展,将算力消纳能力作为项目审批的重要考量,并严格控制非枢纽节点及低水平重复的千卡级项目建设。
成熟的“投建运”一体化模式正在行业普及。李观澜对记者表示,作为第三方算力调优公司,在实操中,他们已从单一售卖技术服务,转向串联芯片厂商、终端客户,为地方提供整套算力消纳方案,以锁定长期订单撬动建设资金,实现立项阶段供需匹配。
针对存量闲置国资算力资产,业内已经跑通“分级评估、针对性改造、全量客户对接”模式,验证出“所有权与经营权分离”的解决路径。
“三分建设七分运营。”赵鸿冰表示,“行业正在形成共识——算力产业核心价值不在硬件资产,而在高可用调度、全栈平台支撑、客户服务与用户消纳能力。”
赵鸿冰向记者介绍,公司已接入全国63家算力中心,覆盖国家级超算、运营商、地方国资、民营算力四大主体,采用灵活合作模式,可接受全量托管或部分资源代运营服务。
但也需看到,并非所有老旧产能都能盘活。赵鸿冰分析,部分硬件代际过旧、适配周期远超数周、客户实际使用性价比完全不及新卡的老旧资产,会自然完成市场化出清。
全行业共识正在逐步形成,引导智算产业跳出粗放扩张的旧路径,进入高质量发展的正向循环。
宋晓提出三点行业指引:按需匹配算力硬件,从源头避免新增闲置;通过算法轻量化、算子优化,依托价格优势,让小型算力设施承接中小微、科研需求,逐步释放存量闲置算力价值;着力缓解大流量数据跨区域传输的带宽和时延瓶颈,完善东西部算力传输通道。
王慧平表示,行业需彻底摒弃堆硬件的粗放思维。一方面,推行政企资产所有权、经营权分离,引入专业化、精细化运营团队;另一方面,尊重国产芯片迭代规律,避免盲目冒进建设,引导下游为优质算力服务付费,破除国产芯片补贴式低价“内卷”,让资金向头部优质企业集中。
(文章来源:证券时报)