搜索
当前所在位置: 首页>行业新闻

AI算力缺货从GPU烧到了一整条产业链?

发布时间:2026-05-27 10:07:39 作者:超级管理员 点击:30 【 字体:

2026年,一场覆盖芯片、云、服务器与数据中心零部件的全产业链算力短缺正席卷全球。从GPU、CPU、HBM,到光模块、铜缆模块、高速交换机、电力与液冷设备,乃至云计算和Token资源,几乎全线供不应求。算力稀缺与全线涨价,已成为贯穿整个AI产业的核心叙事。这并非简单的供需错配,而是AI算力架构升级带来的系统性重构。

AI算力

01 需求爆发与供给钝化的双重挤压

需求端的结构性跃迁是这轮短缺的首要驱动力。AI正从“对话”走向“工作”——Agent(智能体)大规模进入真实生产环境。

IDC预测:

全球活跃Agent数量将从2025年的2860万增至2030年的22.16亿,五年后将是目前的近80倍。

中国市场的数据更具冲击力:截至2026年3月,国内日均Token调用量已

突破140万亿,相比2024年初的1000亿,两年间增长超千倍。供给端同样深刻受限。半导体和数据中心是重资产、长周期行业。SK海力士、三星、美光、英伟达、英特尔、AMD……扩产都需要漫长周期。行业普遍判断:短缺和涨价趋势至少持续1至2年。

02 存储:从配角走向主角

AI算力需求向内存倾斜,存储的价值占比发生剧烈重构。摩根士丹利报告显示:英伟达下一代Vera Rubin(VR200)机架ODM采购价约780万美元,较GB300的约400万美元几乎翻倍。其中,内存占BOM比重从GB200/GB300的7%~9% 飙升至Rubin的26%,GPU占比则从约65%降至约51%。

CIC灼识咨询董事总经理柴代旋:

“Rubin机架价格暴涨,核心原因不是GPU变贵,而是物理瓶颈从算力转向内存和互联。”

存储短缺的刚性超出预期。

2026年HBM市场规模预计增长58% 至546亿美元,占DRAM市场近四成。

三大原厂将70%的新增产能倾斜至HBM,产能缺口仍高达50%~60%。

美光科技在摩根大通峰会上预警:HBM、DRAM及NAND供应紧张将远远超出2026年。市场此前预期的“2026年下半年缓解”已被打破。HBM目前占AI服务器成本的35%~40%,2026年全年产能被提前锁定,二季度合约价预计环比上涨58%~75%。HBM对产能的挤占也波及消费电子——消费级DRAM、NAND趋紧,智能手机等终端面临涨价压力。

03 被动元件:被重新定义的瓶颈卡位

被动元件正经历一场无声的价值重估。村田制作所数据:

GB300 AI服务器:约3万颗多层陶瓷电容(MLCC)

VR200单机柜:飙升至约60万颗,高出30%以上

尽管2025年AI服务器仅占全球出货量的约1.1%,但它们将消耗MLCC总产能的7.5%。高端MLCC的结构性短缺已经形成。国金证券将电容从“配套环节”重新定义为新的“瓶颈卡位”。MLCC供需缺口预计在2026年下半年进一步扩大,尤其是小尺寸、高容值型号,扩产周期长达12~18个月,短期内难以缓解。

04 先进封装:CoWoS短缺仍未停歇

先进封装正成为决定AI芯片出货上限的核心变量。TrendForce指出:自2023年起,3nm至2nm晶圆、2.5D/3D封装陷入严重产能瓶颈。CoWoS的短缺从未停歇,已引发设备、载板及关键原物料全面告急。前端3nm先进制程由台积电独家供应,产能更加吃紧。天风证券: 先进封装可带动单芯片价值量提升30%~50%,封测产业价值链正深刻重构。

ABF载板预计从2027年起进入持续短缺状态。

T型玻璃基板紧缺可能持续至2028年。

英特尔CEO陈立武举例:有客户突然要求产量“拉高三倍”,英特尔必须花费多个季度才能赶上。微小耗材同样成为隐性卡点——钻针(直径不到0.2毫米)用于高多层PCB板钻孔,长径比达30倍以上的高端微钻针极度稀缺。

05 电力:无法被资本加速的终极瓶颈

当算力走向万卡、十万卡集群,电力基础设施的制约浮出水面。IREN首席执行官丹尼尔·罗伯茨:今天开始建设的吉瓦级AI数据中心,可能要到2030年之前才能让算力上线。规划、环评、征地、设备制造、施工——每个环节都无法通过加价来缩短。行业报告显示:2026年美国计划建设的数据中心中,近一半面临延期或取消,主因不是GPU缺货,而是电力基础设施短缺。大型变压器、开关设备交货期已延长至2~3年。摩根士丹利估算:美国数据中心面临约55GW的电力缺口。当瓶颈存在于物理世界的电网侧,资本的力量被大幅削弱。

06 价值重构:谁在承接算力缺口

算力短缺正在重塑产业链的价值分配。GPU在机架成本中的占比大幅下降,内存、PCB、MLCC、ABF载板、电力设施等环节的权重同步提升。资本市场已经做出反应:

纳斯达克中国金龙指数连续走高

A股算力板块价值重估

海光信息、寒武纪、摩尔线程

等国产AI芯片公司股价长期处于高位

工业富联、中际旭创等企业市值纷纷创下新高

这轮算力短缺,并不同于传统意义上的周期性供需失衡。它的本质更像是一台飞轮转得太快、齿轮尚未完全咬合所产生的结构性断层。随着Rubin等下一代平台的逐步量产,瓶颈还会沿着产业链继续传导:从GPU到HBM,从CoWoS到MLCC,从液冷系统到高压变电站。每一处卡住的环节,都在重构整个AI硬件世界的价值坐标。


阅读全文
相关推荐

GPU服务器中的ETH、RDMA、GID、NVLink分别是什么?

GPU服务器中的ETH、RDMA、GID、NVLink分别是什么?
英伟达的旗舰机型,GB300的核心优势不止在于Grace CPU+Blackwell Ultra GPU的超强硬件配置,更在于一套分层、高速、低延迟的互联传输体系。很多时候会被四个名词绕晕:ETH、GID、RDMA、NVLink。它们到底各自是什么?谁负责内网、谁负责外网?谁依赖谁、谁限制谁?算力跑不满、集群通信卡顿、RDMA掉线,根源大多藏在这四者的...

西方锁死“空间”,华为征服“时间”:τ定律背后的算力大置换

西方锁死“空间”,华为征服“时间”:τ定律背后的算力大置换
5月25日,全网舆论场被娱乐热搜、日常琐事填满,大众沉浸在碎片化的热闹里,几乎无人留意,科技界悄然发生了一件改写人类半导体60年规则的里程碑事件。华为正式发布国产算力首个全球标准——韬(τ)定律。这不是一次普通的技术发布会,不是又一款芯片的迭代升级,更不是一场行业噱头式的概念炒作。这是一份赤裸裸的摩尔定律...

一文搞懂算力网、算力并网、算网融合的区别与作用

一文搞懂算力网、算力并网、算网融合的区别与作用
一、先说一下它们分别是什么?1、算力网先来看一下官方对于算力网的定义:算力网是以高速智能网络为物理纽带,以统一标准、统一标识、统一调度为核心机制,统筹通用算力、智能算力、超级算力等全域异构资源,实现跨区域、跨层级、跨主体高效协同与按需供给的国家级数字基础设施。看起来比较宏观、抽象,也不太好理解。其实,...

AI算力缺货从GPU烧到了一整条产业链?

AI算力缺货从GPU烧到了一整条产业链?
2026年,一场覆盖芯片、云、服务器与数据中心零部件的全产业链算力短缺正席卷全球。从GPU、CPU、HBM,到光模块、铜缆模块、高速交换机、电力与液冷设备,乃至云计算和Token资源,几乎全线供不应求。算力稀缺与全线涨价,已成为贯穿整个AI产业的核心叙事。这并非简单的供需错配,而是AI算力架构升级带来的系统性重构。01 需求...

全球竞争格局下的中国AI模型:激流勇进,但信任尚待跨越

全球竞争格局下的中国AI模型:激流勇进,但信任尚待跨越
在全球AI竞争格局中,中国AI模型在技术能力上已与北美差距缩小,但在海外市场渗透与用户信任方面仍面临显著挑战。当前,AI模型正从“工具”演进为“基础设施”,其能力已成为衡量企业技术竞争力与未来增长空间的核心指标。与此同时,Agent的繁荣并未削弱模型的重要性,反而放大了模型能力的差距。未来,谁掌握更强的模型、数...

约20亿投资·140MW供电·万P算力·PUE低于1.23尚航无锡(惠山云)国际智算中心深度分析

约20亿投资·140MW供电·万P算力·PUE低于1.23尚航无锡(惠山云)国际智算中心深度分析
一、项目概况与战略定位尚航无锡(惠山云)国际智算中心位于无锡市惠山区锦惠路10号,是尚航科技在长三角枢纽布局的核心算力节点。项目于2017年启动建设,总投资超20亿元,占地近百亩,规划建筑面积约66600平方米,机柜总量15500个,IT容量近100MW。该中心是尚航科技环上海、环北京、环广州三大算力节点布局的关键一环,也是...

GTX显卡和RTX显卡的区别是什么?

GTX显卡和RTX显卡的区别是什么?
TX 与 RTX 的核心差异在于架构代际、专用硬件单元与新技术支持:RTX 具备硬件级光线追踪与AI 超分(DLSS),GTX 无专用单元,仅能软件模拟光追、不支持 DLSS。核心差异速览关键技术解释RT Core(光线追踪核心):RTX 专属,加速光线求交与反射 / 折射 / 阴影计算,光追效率远高于 GTX 的软件模拟。Tensor Core(张量核心):...

融信云乌兰察布数据中心正式启用

融信云乌兰察布数据中心正式启用
近日,融信云乌兰察布数据中心正式启用,并已顺利完成重要客户灾备业务整体迁移工作。融信云积极响应国家“东数西算”战略号召,将业务核心灾备节点从武汉迁移至乌兰察布,一方面有效降低整体运营能耗与综合成本;另一方面借助当地政策扶持与产业集聚效应,构建起绿色、低碳、弹性的金融算力底座。此次迁移,融信云成功完成...

2026 大模型 GPU 选型全指南|从消费游戏卡到超算卡,适配全系列 DeepSeek 模型部署

2026 大模型 GPU 选型全指南|从消费游戏卡到超算卡,适配全系列 DeepSeek 模型部署
随着 DeepSeek 全系列开源模型(1.5B/7B/13B/32B/67B/671B 稠密大模型)大范围落地私有化部署,显卡显存容量、单 / 双精度算力、显存带宽、多卡互联能力成为选型核心。市面上显卡分为:消费游戏卡(RTX3090/4090/5090)、专业可视化推理卡(A6000/L40/L40S/A10)、超算训练卡(A100/A800/H100/H800/H200) 三类,从硬件参数...

呼和浩特 H100*8卡 45台 现货出租

呼和浩特 H100*8卡 45台 现货出租
GPU裸金属服务器-A100*8CPU: 2*Intel Xeon Gold 6248R(24Core,3.0GHz)内存:24*32GB系统盘:2*480GBSATA SSD数据盘:4*1.92TB NVMe SSD显卡:Nvidia A100 PCIE 40G *8网卡:1 x2*25GE...
返回顶部