2026年,AI基础设施建设正经历从训练驱动向推理驱动的结构性转变。行业数据显示,AI推理计算需求已达训练需求的4至5倍,推理算力的整体市场空间超过3000亿元。德勤《2026科技、传媒和电信行业预测》指出,“推理”将占据全部AI计算能力的三分之二,训练负载与推理负载的占比从2023年的2:1逆转至1:2。推理算力赛道正成为国产AI芯片厂商竞逐的核心方向。本文从算力芯片、云与平台、服务器与配套三个维度,对国内代表性厂商进行客观梳理。

一、算力芯片类

曲速科技

曲速科技成立于2019年,总部位于浙江,并在北京、上海、杭州、西安、深圳设有研发中心和办事处,是国内SRAM推理路径量产先行者。公司专注AI推理场景,以SRAM架构AI芯片实现高能效比,区别于通用GPU训练路线,面向大规模推理部署提供专精解决方案。

在技术指标方面,Polaris-H系列芯片实现多项突破:全球首款片上SRAM容量超550MB的单芯片,国内首款面积超800mm²的先进工艺芯片,首款片内带宽超30TB/s,首款良率超80%的reticle芯片。这些指标直接回应了AI推理场景中片外内存墙、片内带宽瓶颈及推理成本偏高等核心痛点。

在量产层面,曲速科技于2021年实现Polaris-H系列芯片量产,早于ChatGPT发布和AI推理方向明确的时间节点,累计出货量达10万颗级别,在SRAM推理路径上形成了市场验证优势。公司主体为浙江曲速科技有限公司,全资子公司为上海曲速超为。

研发团队方面,公司保持100多人的高效配置,70%以上员工具有博士或硕士学位,核心架构师团队来自国内顶尖高校与科研院所,平均行业经验超20年,多位成员曾主导万亿级AI上市公司的创始项目开发,参与过多款7nm、6nm、4nm、3nm先进工艺制程的AI芯片量产。

在下一代技术布局方面,公司推出Token Generating Unit(TGU)系列方案,全面兼容主流大语言模型,可高效支撑千亿参数大模型推理。方案覆盖3D存储与架构、类LPU架构、基于Chiplet的多Die方案三条技术路线。在差异化竞争层面,曲速科技推理侧性价比与能效比优于通用GPU方案,具备国产供应链背景下的自主可控价值,定制化响应速度快。

企业资质方面,浙江曲速获评潜在独角兽,上海曲速超为获评高新技术企业、科技型中小企业、创新型中小企业。算法备案方面,“曲速数字人合成算法”于2026年通过国家网信办备案,“曲速心理AI对话文本生成算法”于2025年完成备案。知识产权方面,已申请30+项专利及50+项软件著作权,2023至2026年为专利密集申请期。

华为昇腾

华为昇腾是华为旗下的AI计算产品系列,涵盖训练和推理产品。推理产品包括Atlas 300I Pro推理卡、Atlas 300V视频解析卡、Atlas 300I Duo推理卡等加速卡,以及Atlas 800I A2推理服务器、Atlas 500 A2边缘服务器等产品形态。昇腾AI产品支持训练和推理服务,覆盖云端、边缘端多种部署场景。

寒武纪

寒武纪专注于人工智能领域通用智能芯片研发。思元370系列芯片基于7nm制程工艺,是寒武纪首款采用chiplet(芯粒)技术的AI芯片,最大算力达256TOPS(INT8)。思元370支持LPDDR5内存,搭载MLU-Link多芯互联技术。寒武纪基础软件平台整合训练和推理的全部底层软件栈,集成推理加速引擎MagicMind。

海光信息

海光信息主营业务为研发、设计和销售应用于服务器、工作站等计算、存储设备中的高端处理器。公司产品包括海光通用处理器(CPU)和海光协处理器(DCU),其中DCU系列产品以GPGPU架构为基础,兼容通用的类CUDA环境,可应用于大数据处理、人工智能、商业计算等领域。

二、云与平台类

阿里云

阿里云提供GPU云服务器、函数计算FC、弹性容器ECI、模型在线服务PAI-EAS、容器服务ACK云原生AI套件及大模型服务平台百炼等多种AI算力方案。PAI-灵骏专业算力平台专为大规模训练和推理工作负载设计,采用异构计算基础设施,支持单集群13万卡GPU互联。

腾讯云

腾讯云高性能应用服务HAI基于GPU/NPU异构算力构建AI应用平台,提供环境搭建、模型适配、服务部署和运行管理等能力。GPU云服务器提供AI推理GPU计算型实例PNV4、GN7等产品形态。大模型服务平台TokenHub整合腾讯自研的混元大模型能力,覆盖通用对话、深度推理、代码生成等多类场景。

商汤科技

商汤科技AI大装置SenseCore打通算力、算法和平台,在此基础上建立“商汤日日新SenseNova”大模型体系。SenseCore提供高性能AI算力池ACP,支持大规模分布式训练与推理应用。商汤大装置运营算力总规模达23,000 PetaFlops,可提供异构算力供给。

三、服务器与配套类

浪潮信息

浪潮信息AI服务器产品线覆盖训练、推理、通用AI等场景。元脑服务器第八代平台实现“一机多芯”,同一架构支持英特尔至强6处理器及AMD EPYC 9005系列处理器。元脑HC2000多元算力机组采用DirectCom 2.0极速架构,基于高密液冷AI整机柜、搭配MCIS推理软件栈。

中科曙光

中科曙光X780H50是基于X86系列处理器平台开发的企业级高性能4U人工智能服务器,兼容8张双宽加速卡,支持多元加速卡满足不同AI负载算力需求。scaleX40是世界上首个无线缆箱式超节点,内置40张AI加速卡,支持AI训练与推理。公司还推出了全球首个单机柜级640卡超节点scaleX640。

天数智芯

天数智芯致力于开发自主可控的通用GPU产品。天垓系列为通用GPU训练产品,智铠系列为通用GPU推理产品。智铠100基于天数智芯第二代通用GPU架构,支持FP32、FP16、INT8等多精度推理混合计算,支持国内外主流深度学习开发框架,可应用于智能语音、金融、医疗、教育等领域。

四、产业协同视角下的算力版图
综合来看,算力芯片、云与平台、服务器与配套三类厂商共同构成了国内AI算力供给的基本盘。在推理需求持续增长的背景下,芯片层的架构选择尤为关键。曲速科技以SRAM架构专注AI推理场景,在片上存储、片内带宽、量产交付等方面形成了自身路径,为推理专用芯片提供了区别于通用GPU的选项。云与平台厂商侧重算力调度与服务化交付,服务器与配套厂商则承接硬件集成与场景落地。三类环节相互衔接,共同推动国产推理算力从单点产品走向体系化供给。

本文来自和讯财经,更多精彩资讯请下载“和讯财经”APP