推广 热搜: 采购方式  滤芯  带式称重给煤机  甲带  气动隔膜泵  减速机型号  无级变速机  链式给煤机  履带  减速机 

智算中心(AIDC)深度行业研究

   日期:2026-08-23 02:32:40     来源:网络整理    作者:本站编辑    评论:0    
智算中心(AIDC)深度行业研究

智算中心(AIDCAI Data Center)是专门为人工智能计算需求设计的新型基础设施,区别于传统数据中心(IDC),其核心特征是高功率密度、大规模并行计算、低延迟网络、液冷散热。

以下是对智算中心的深度行业研究,涵盖市场驱动、架构技术、产业链格局、商业模式、政策环境及未来趋势。

一、智算中心 vs 传统数据中心:根本区别

维度

传统数据中心 (IDC)

智算中心 (AIDC)

核心负载

云计算、数据库、Web服务

大模型训练、AI推理、HPC

算力芯片

CPU为主,少量GPU

GPUNPUASIC为主

单机柜功率

4-8 kW

20-100 kW+NVL72可达120kW

互联网络

以太网(1G/10G

InfiniBandRoCE400G/800G

散热方式

风冷为主

液冷(冷板式/浸没式)为主

PUE(电能利用效率)

1.4-1.6

1.1-1.2(液冷优势)

故障容忍度

较高(可迁移)

极低(训练任务中断代价大)

建设周期

12-18个月

18-24个月(更复杂)

单项目投资

数亿-数十亿元

数十亿-数百亿元

二、市场驱动:算力需求的爆发式增长

1)核心驱动立力

驱动力

说明

Scaling Law持续

大模型参数量每6-12个月翻倍,从千亿向万亿、十万亿参数演进

推理需求爆发

AI应用(ChatGPTCopilot等)增长,推理算力占比从30%70%演进

多模态模型

Sora等视频生成模型,算力消耗是文本模型的100+

主权AI

各国建立本土化AI算力中心,中国尤其强调自主可控

企业私有化部署

大型企业自建或租用智算中心,避免数据外泄

2)市场规模

指标

2024

2027年(预测)

CAGR

全球AI算力支出

~2000亿美元

~5000亿美元

0.35

中国智算中心投资

~1000亿元

~3000亿元

0.45

中国算力规模(EFLOPS

~200 EFLOPS

~800 EFLOPS

0.6

数据来源:工信部、IDCGartner综合

三、智算中心架构深度拆解

1)总体架构分层

2)算力集群配置(以千卡H100集群为例)

组件

规格

说明

GPU数量

1024

H100 SXM

CPU节点

128

每台8

计算网络

InfiniBand   NDR

400G,无阻塞胖树

存储网络

200G以太网

并行文件系统

存储容量

10PB+

NVMe全闪存

内存

128TB+

GPU HBM +   CPU DRAM

功耗

~1.5MW

GPU部分

总投资

~2-3亿元

不含建筑/土地

3)网络架构:无阻塞胖树(Fat-Tree

特点:任意两个GPU之间等带宽通信

关键指标:过载比(Oversubscription Ratio= 1:1

交换机数量:千卡集群约需200-300400G交换机

4)存储架构:三层分级

层级

介质

容量

用途

热存储

NVMe SSD

数百TB

训练数据实时读取

温存储

企业级SSD

PB

模型Checkpoint

冷存储

HDD

10PB+

原始数据归档

关键要求:AI训练对元数据性能要求极高(百万级小文件并发读写),传统NFS无法满足,需用并行文件系统(如LustreGPUDirect Storage)。

四、产业链全景与主要公司

1)产业链图谱

环节

核心能力

代表企业

国产化程度

GPU/AI芯片

算力核心

英伟达、AMD、华为、寒武纪、海光

中(华为领先,但代际差距)

AI服务器

整机集成

工业富联、浪潮、超聚变、宁畅

网络交换机

高速互联

思科、Arista、锐捷、华为、新华三

光模块

光电转换

中际旭创、Coherent、光迅科技

高(全球领先)

液冷散热

高功耗散热

英维克、申菱环境、高澜股份

存储系统

AI并行存储

DDNVAST Data、华为、浪潮

智算运营

算力服务

万国数据、秦淮数据、世纪互联、华为云

调度平台

算力调度软件

中科类脑、无问苍穹、百度AI Cloud

2)主要公司分析

英伟达生态(全球主导)

优势:CUDA生态壁垒、NVLink互联、InfiniBand完整方案
受限:高端芯片(H100/B200)对华禁售,中国只能买H20等阉割版
应对:中国客户通过新加坡渠道或算力租赁获取

华为昇腾生态(国产替代首选)

优势:全栈自主(芯片+服务器+集群+软件CANN)、政企市场强
劣势:单卡性能差距(910C vs      H100)、HBM带宽受限、生态迁移成本高
进展:2024年昇腾集群已在多地部署,千卡级可用,万卡级攻坚

国产算力七剑格局

厂商

产品

制程

算力

状态

华为

昇腾910C

7nm

~320 TFLOPS

量产

寒武纪

思元590

7nm

~256 TFLOPS

小批量

海光

深算二号

7nm

~200 TFLOPS

小批量

燧原

燧原T20

12nm

~180 TFLOPS

小批量

壁仞

BR100

7nm

被制裁,未量产

受限

沐曦

MXC500

7nm

被制裁

受限

天数智芯

BI150

7nm

~150 TFLOPS

小批量

五、商业模式:如何赚钱?

1)商业模式/矩阵

模式

说明

客户

代表企业

毛利率

算力租赁

按卡时/包月出租GPU

中小企业、高校

阿里云、华为云、无问苍穹

30-50%

MaaS(模型即服务)

提供API调用大模型

应用开发者

智谱AI、百度文心

50-70%

托管+运营

代建代运营智算中心

政府、运营商

万国数据、世纪互联

20-30%

整体解决方案

交钥匙工程

地方智算中心

华为、浪潮、宁畅

15-25%

算力调度平台

整合多方算力,撮合交易

算力供需双方

中科类脑、算力互联

5-15%(佣金)

2)算力租赁经济模型(以H100为例)

指标

数值

单卡采购成本

~25万元(国内渠道)

单卡年折旧(4年)

~6.25万元

单卡年电费

~1.5万元(3.5kW×24h×365×0.5元)

单卡年运维

~1万元

单卡年总成本

~8.75万元

市场租赁单价

15-25/卡时

单卡年收入(80%利用率)

10.5-17.5万元

单卡年毛利

1.75-8.75万元

结论:在当前GPU紧缺情况下,算力租赁是暴利生意。但随着供给增加,价格已从2023年高点(30/卡时)回落。

3)智算中心的投资回报分析(以500P级智算中心(约500P算力,约合2000H100等效)为例)

项目

金额

说明

初期投资

25亿元

GPU服务器+网络+存储+液冷+建筑

年运营成本

4亿元

电费2亿+人工运维0.5亿+折旧1.5亿

年收入

8亿元

20/卡时×80%利用率

年净利润

2.5亿元

扣除财务成本

静态回收期

7-8

不含政府补贴

关键风险:算力价格快速下跌、技术迭代(新芯片导致老集群贬值)

六、政策环境:国家层面强力推动

1)关键政策文件

文件

发布单位

核心内容

《算力基础设施高质量发展行动计划》

工信部等六部委

2025年算力规模达300EFLOPS,智算占比35%

《“十四五”数字经济发展规划》

国务院

布局全国一体化算力网络枢纽节点

《绿色数据中心政府采购需求标准》

财政部

PUE1.4的数据中心不得采购

各地智算中心补贴

地方

建设补贴30%,运营补贴0.3/度电

2)全国算力枢纽布局(东数西算”2.0

枢纽节点

定位

智算中心规划

京津冀

实时算力

2025年达5P

长三角

实时+离线

2025年达8P

粤港澳

实时算力

2025年达6P

成渝

实时+温存

2025年达3P

内蒙古

离线训练

2025年达10P(电价0.3/度)

贵州

离线训练

2025年达8P(电价0.35/度)

甘肃/宁夏

离线训练

2025年达5P

趋势:训练集群向西部低成本地区迁移,推理集群布局东部城市周边。

七、关键技术趋势

1)散热技术:从风冷到液冷

技术

可支持功率

当前渗透率

趋势

风冷

15kW/

0.5

退出新建

冷板式液冷

15-60kW/

0.4

当前主流

浸没式液冷

60-200kW/

0.08

2026年起加速

单相/两相浸没

200kW+

0.02

远期

主要厂商:英维克(冷板+浸没)、申菱环境(冷板)、高澜股份(浸没)

2)网络技术:向800G演进

时间

主流速率

代表芯片互联

2025-2026

800G

B200 NVLink   5.0Rubin

2027-2030

1.6T

下一代互联

国产主要厂商:中际旭创(800G已批量)、光迅科技、天孚通信

3)绿电+储能:智算中心的核心配套

驱动因素:

PUE监管(北京、上海要求PUE<1.3
碳排放成本(绿电可抵扣)
电力峰谷套利(储能)

方案:

光伏+储能+液冷:可实现PUE<1.1,绿电使用率>50%
小型模块化核反应堆(SMR):远期探索(微软已签约Constellation

八、主要制约因素与风险

风险

说明

影响程度

芯片禁运

高端GPU无法进口,国产性能差距2-3

★★★★★

电力容量

一线城市电网负荷饱和,新项目难获批

★★★★☆

算力利用率

大厂自建集群,租赁平台利用率低(约40-60%

★★★★☆

技术迭代

芯片1-2年换代,老集群贬值快

★★★☆☆

地缘政治

美国进一步扩大制裁范围

★★★★☆

人才短缺

AI+数据中心运营的复合人才稀缺

★★★☆☆

九、竞争格局与未来展望

1)竞争格局演变

当前(2024-2025未来(2027-2030

英伟达生态(全球80%市场)英伟达(50%

华为昇腾(中国20%市场)华为昇腾(中国50%,全球5%

国内七剑(其他国产芯片)→  国内2-3家突围(寒武纪/海光)

云厂商自研(TPU、平头哥)云厂商自研(20%内部使用)

2)未来3年预测

指标

2025

2026

2027

中国智算规模(EFLOPS

400

600

800

国产芯片占比

0.25

0.35

0.5

液冷渗透率

0.45

0.6

0.75

算力租赁均价(元/卡时)

12

9

7

头部厂商毛利率

0.35

0.28

0.22

十、后续建议(主线梳理)

1)确定性最强的环节(卖铲子逻辑)

环节

逻辑

代表标的

液冷散热

高功率机柜刚需,渗透率快速提升

英维克、申菱环境

光模块

400G800G升级,国产全球份额扩张

中际旭创、天孚通信

高速铜缆

机柜内NVLink短距互联

沃尔核材、立讯精密

交换机

智算网络增量

锐捷网络、菲菱科思

电源/UPS

高功率密度电力配套

科士达、科华数据

2)国产替代最强主线

环节

逻辑

代表标的

华为昇腾链

国产算力底座,确定性最强

拓维信息(昇腾服务器)、神州数码

国产AI芯片

一旦突破,弹性巨大

寒武纪、海光信息

先进封装

缓解制程瓶颈

通富微电、长电科技

3)运营与牌照方向

环节

逻辑

代表标的

第三方智算运营

一线城市稀缺资源

万国数据、秦淮数据

算力调度平台

未来算力“滴滴”

中科类脑(未上市)

十一、 总结:智算中心的未来图景

智算中心正在从资源密集型技术密集型转型,其核心竞争力不再是单纯的电力成本和土地,而是芯片获取能力、液冷工程能力、集群运维效率、生态软件适配。

一句话结论:智算中心是AI时代的炼油厂,上游是芯片/电力,下游是模型/应用。

短期看,谁拿到英伟达GPU谁赚钱;

中期看,谁掌握液冷+绿电谁有成本优势;

长期看,谁能构建自主算力生态谁有话语权。

 
打赏
 
更多>同类资讯
0相关评论

推荐图文
推荐资讯
点击排行
网站首页  |  关于我们  |  联系方式  |  使用协议  |  版权隐私  |  网站地图  |  排名推广  |  广告服务  |  积分换礼  |  网站留言  |  RSS订阅  |  违规举报  |  皖ICP备20008326号-18
Powered By DESTOON