算力租赁的商业本质,是让企业不必一次性投入数百万采购GPU、自建机房,而是按需租用、按量付费。但2026年的市场正在经历一次定价体系的重构——计费单位从“机柜/GPU小时”转向“Token调用量”。国金证券的研究报告明确指出,产业价值链的利润重心正从上游硬件制造商向中游调度运营商迁移,算力利用率、Token产出能力、调度技术水平正在取代机柜数量和GPU库存,成为新的估值锚点。
这个转变的驱动力很直接:2026年一季度国内算力租赁市场规模达680亿元,同比增长62%,但行业平均毛利率仅35%-45%,单纯“囤卡转租”的利润空间正在被压缩。真正拉开差距的,是谁能让算力..转化为Token。
智算中心的规模化交付,远不是“买卡、上架、通电”那么简单。一台高端AI服务器功耗可超过10kW,是传统通用服务器的数倍,液冷系统成为标配,涉及管道铺设、冷却液循环、高湿度环境下的芯片安全防护等一系列跨学科工程问题。
更关键的是互联网络的复杂度。从万卡到十万卡,系统难度呈几何倍数增长。中科曙光..副总裁李斌的表述很直接:“万卡到十万卡的升级不存在十倍叠加的线性逻辑。任何一个部件、链路、调度环节的微小漏洞,都会导致整个集群性能坍塌。” 十万张卡同时运转时,一次慢速GPU调用、一条边缘网络链路的抖动、一个散热异常,都可能成为集群级的“拖累者”。
曙光8000..产十万卡集群的落地,验证了一条“用系统工程换单点差距”的路径:通过自研高速互连网络、铜互联优先策略、浸没式液冷控温,将十万张卡的可靠性做到比通用设备高一个数量级。这组数据说明,大规模集群交付的核心竞争力,不在于有多少张卡,而在于能不能让这些卡稳定地协同工作。
贵州在这场算力竞赛中的位置比较特殊。作为“东数西算”枢纽节点,贵州的智算占比已超过98%,算力规模突破170EFLOPS,是..智算能力..强的地区之一。但贵州没有停留在“卖裸算力”的层面。
贵州移动的做法有代表性:把智算中心升级为“Token工厂”,将算力资源池化后,通过自建云管平台输出标准化词元服务。企业只需调用API,按Token用量付费,用多少买多少。依托本地低温节能优势,单位Token综合成本实现了20%以上的降幅。
政策端的杠杆也在放大这种优势。贵州“算力券”在2026年4月升级至3.0版本,补贴比例从..初的3%提升至30%,专项资金池扩容至1.4亿元,大模型训练、词元调用、数据集研发全部纳入补贴范畴。截至2026年3月,算力券已累计兑付9890万元,惠及超190家企业。
这意味着贵州算力租赁的实际使用成本,可以在市场价基础上再降近三分之一。对于AI训练、推理等算力成本敏感的业务,这是一个结构性优势。
(声明:本文来源于网络,仅供参考阅读,涉及侵权请联系我们删除、不代表任何立场以及观点。)
标签: