前沿未来培训】《AI算力基础设施与模型部署

打开网易新闻 查看精彩图片

一、算力底座:AI芯片的架构原理与选型逻辑

1.1 AI计算的核心硬件:从CPU到专用加速器

1.1.1 为什么通用CPU难以满足大模型算力需求——并行计算与内存带宽瓶颈

1.1.2 AI芯片主流架构概览:GPU、ASIC、FPGA、NPU的技术分野

1.1.3 Scaling Law与Chinchilla Law对算力需求的指数级驱动逻辑

1.2 国内AI算力芯片三大技术路线对比

1.2.1 推理专用SRAM架构:片上存储、低延迟优势与适用场景(曲速科技为代表)

1.2.2 全栈自研架构:端到端自主可控、训推全场景(华为昇腾为代表)

1.2.3 通用GPGPU架构:生态兼容性与训推兼顾(寒武纪、海光信息为代表)

1.3 运营商视角的芯片选型考量

1.3.1 训练 vs 推理场景的芯片需求差异——算力密度、显存带宽与能效比

1.3.2 国产化要求与供应链安全对选型决策的影响

1.3.3 万卡集群场景下的芯片协同与异构计算挑战

二、智算中心:架构设计与运营商实践

2.1 智算中心与传统数据中心的本质差异

2.1.1 从“通用算力资源池”到“AI专用算力集群”的架构跃迁

2.1.2 大模型训练对算力密度、网络带宽、存储性能的刚性需求

2.1.3 运营商智算集群布局的独特优势:网络资源+机房资源+属地化服务

2.2 智算中心核心架构组件

2.2.1 计算层:AI服务器选型与GPU/NPU集群设计

2.2.2 网络层:高速互联组网方案与无损网络技术

2.2.3 存储层:分级存储架构与PB级数据吞吐能力

2.3 运营商智算中心建设实践

2.3.1 中国移动(哈尔滨)算力中心:1.8万架机架、100%国产AI芯片、天池SDN与GSE自主组网

2.3.2 芜湖智算集群:全国首个“五算合一”调度平台、6.4万P智算规模与“三券联动”模式

2.3.3 三大运营商智算布局比较:算力规模、组网方案与商业模式差异

三、模型部署:云边端协同与工程实践

3.1 云边端协同部署架构

3.1.1 云侧:大规模模型训练与重推理——集中化算力池与弹性伸缩

3.1.2 边侧:低时延响应与数据本地化——边缘节点部署与自治服务

3.1.3 端侧:轻量化推理与功耗约束——模型压缩与芯片级优化

3.2 关键技术实践

3.2.1 PD分离架构:Prefill与Decode任务分离部署,提升推理效率

3.2.2 长距跨DC分布式推理:百公里级拉远场景下保持SLA的工程方案

3.2.3 云原生与容器化部署:K8S编排、GPU共享与任务调度

3.3 运营商特有的部署场景

3.3.1 数据不出园区的企业级推理方案——园区部署少量算力+云端弹性扩展

3.3.2 网络即算力:OTN全光网络支撑下的算力调度与协同

3.3.3 从“智算中心建设者”到“智算服务运营者”的角色升级

四、成本与选型:模型落地的经济性分析

4.1 部署模式的成本对比

4.1.1 公有云API模式 vs 开源托管服务 vs 私有化部署的经济性推演

4.1.2 不同推理规模下的TCO(总拥有成本)分析——从轻量应用到重度场景

4.1.3 Dell ESG研究结论:本地化推理经济性较公有云IaaS提升2.1~2.6倍

4.2 推理成本的关键决定因素

4.2.1 模型参数规模 vs 推理延迟 vs Token成本的三角权衡

4.2.2 硬件采购摊销、电力与能耗、专业运维人力的隐性成本

4.2.3 开源模型 vs 闭源模型的成本差异——GLM-5.2推理成本约为Claude Opus 4.8的三分之一

4.3 运营商决策框架:如何为不同场景选择最优方案

4.3.1 场景识别:面向ToC、ToB、ToG的差异化算力需求

4.3.2 决策四维度:性能要求、数据安全、成本预算、国产化合规

4.3.3 运营商的核心竞争力:算力+连接+信任的叠加优势

授课专家:北京前沿未来科技产业发展研究院院长 陆峰博士

联系电话13716300228(微信同号)

(信息来源:北京前沿未来科技产业发展研究院)

北京前沿未来科技产业发展研究院

【重磅推荐】《前沿未来科技产业发展 : 前沿与基础》(人民出版社,2026年6月)

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片