文/海峰看科技

当大模型从“会聊天”走向“会干活”,当智能体开始替企业跑通真实业务流程,算力已从锦上添花,变成企业发展的硬核需求。但不同企业对算力的需求千差万别。比如,一家银行的核心系统,需要支撑万亿参数模型的算力集群;一家小微企业,也许只需一台办公桌上的AI工作站。

从大规模行业部署到小微企业轻量化应用,全场景算力需求如何满足?在华为全联接大会2026上,笔者找到了答案:华为公司常务董事、ICT BG CEO杨超斌发布了系列化一体机产品矩阵与Agent加速平台,以分级适配、开箱即用的系列化方案,覆盖全场景算力需求。

打开网易新闻 查看精彩图片

行业拐点:智能体规模化落地,算力升级为“核心刚需”

大模型正加速渗透千行百业,智能体从试点验证转向规模化落地。AI不再是实验室里的演示,而是进入生产系统、承载真实业务。

与此同时,企业也面临新挑战:模型参数从百亿级至万亿级,规模跨度巨大;用户并发需求参差不齐;核心业务对推理时延的要求日益严苛;再加上部署环境、功耗成本与运维能力的多重约束,企业AI算力建设面临诸多现实难题。

不少企业在建设AI算力时容易陷入误区:一味追求大规模算力集群,一味向上堆叠硬件,看似配置豪华,实则徒有其表、资源浪费严重。

盲目堆出来的大集群容易出现资源闲置,导致算力利用率偏低,居高不下的硬件与运维成本难以摊薄,直接引发业务盈利困难,甚至持续亏损的问题。

这就像买衣服,只有一种尺码,永远无法做到人人合身。算力亦然,关键不在“堆得多高”,而在“合不合身”。因此,分级适配、开箱即用的一体化算力新模式,正在成为智能体规模化落地的核心刚需。

系列化算力底座:从中心服务器到边缘部件,覆盖全场景算力

如何为不同规模、不同阶段的企业,实现精准匹配、按需部署?在本次大会期间,笔者看到华为打造系列化、多层级的一体机底座,满足企业对算力设施的不同需求。

面对大中型企业核心业务,Atlas 650/650E性能强劲,成为私有化部署的最佳选择。该产品搭载昇腾950系列处理器,率先支持mxFP4低精度推理,单卡算力可达1.56 PFLOPS,硬件基础性能强劲。

需要指出的是,华为灵衢高速互联技术不仅用于超节点,也适用于一体机。通过双机灵衢直连,Atlas 650/650E可实现业界唯一16卡Full-Mesh组网,让两台机器像一台一样运行,实现EP16最佳并行切分,进一步提升整体业务落地收益。此外,在企业业务量更大、模型演进需求更高时,16卡以上还能通过高速互联实现平滑扩容。

得益于mxFP4低精度算力与16卡灵衢全互联架构的双重赋能,Atlas 650/650E推理性能实现跨越式升级,相比行业常规互联方案,整体推理吞吐提升70%以上,推理时延低至10毫秒,且支持百万级(1M)超长序列处理,完美适配复杂、高并发的AI业务。

打开网易新闻 查看精彩图片

面对中小企业及轻量化应用,华为开放了Atlas 150加速卡,支持伙伴打造可灵活配置的插卡式服务器。Atlas 150加速卡搭载昇腾950PR处理器,单卡算力1.56 P FLOPS@mxFP4,片上内存84GB@1.4TB/s,支持SIMD与SIMT混合编程,开发适配更灵活。同时支持2卡、4卡灵衢高速互联。伙伴可基于Atlas 150打造单卡~多卡灵活配置的一体机产品,为AI应用提供灵活、轻量、易落地的部署方案。

面对差异化、定制化要求更高的边缘计算场景,华为开放了鲲鹏昇腾模组等部件产品。鲲鹏920模组形成Lite、Smart、Max全矩阵,CPU核数覆盖4至64核,高度集成的设计使能伙伴快速完成整机开发,可适配政务民生、智能制造、网络安全等场景;昇腾开放310B、310P系列智算模组及参考设计,可提供8T至280T算力,支撑开发板、智能终端及具身智能设备。截至目前,华为已联合100 +伙伴,打造10大场景、200余款产品,落地金融、能源、泛政府、教育、医疗等核心行业。

平台闭环:Agent加速平台,以性能与安全筑牢产业落地根基

算力就位只是第一步,真正制约企业智能化转型的核心痛点,集中在企业智能体的高效、安全、稳定落地环节。

不少企业亟需一套软硬协同优化、安全可管可控、适配多Agent推理的专属系统,同时兼顾轻量化、高效率的私有化部署能力。

华为的Agent加速平台,正是为此而生。据笔者了解,该平台集成了Agent推理加速库、智能体管理系统与企业级安全架构,支持客户端、终端、应用IM、推理API等全域接入。

打开网易新闻 查看精彩图片

笔者通过现场与技术工作人员交流,梳理出该平台的三大核心优势。

优势一:极致性能,软硬协同解锁多智能体高效算力

Agent加速平台采用“原生蜂群架构”设计,内置业界领先的完整多智能体生成、协同、调度、进化等能力,可完成复杂企业生产任务。

同时,平台依托A+K(昇腾+鲲鹏)软硬件深度优化,真正使能智能体高效运行,更少内存消耗,更高的性能。

首先,如在资源利用率上,平台针对多智能体场景的内存、算力运行特征,实现了KV Cache主动精细化管理,最小化内存浪费,搭配多级分层KVCache缓存机制,最终整体性能提升50%以上。

另外,在任务加速上,平台实现多Agent协同场景下的推理、工具调用高效异步并发调度,最大化压榨硬件性能。通过全链路底层优化,端到端任务效率提升50%以上,可支撑企业高并发、低时延的智能体业务落地。

优势二:多级沙箱,全链路防护,破解多租户安全难题

企业多用户场景下的隐私保护,以及全流程的智能体管控,是最大的难题。

针对多用户隔离问题,华为搭建了普通沙箱-安全沙箱-加密虚拟机三层防护,可按需选择沙箱,最安全的加密虚拟机,即便平台管理员也无法读取内部数据明文,实现真正的数据安全。

此外,安全防护并非单点防御,而是覆盖业务全生命周期的闭环管控。

在智能体全流程管控上,平台从skill上架、Agent运行、Agent异常意图监控与拦截,异常操作支持回退,最后,所有操作可审计,实现了完整端到端防护,消除了企业的后顾之忧,让企业级Agent敢用、能用。

优势三:开箱即用,轻量化部署降低企业落地门槛

在高性能、高安全的核心底座之上,平台兼顾企业落地便捷性,实现智能化部署“精装修交付”。如果将硬件算力视为智能化建设的“毛坯房”,华为Agent加速平台则为企业提供一站式“拎包入住”体验。

平台支持DeepSeek-V4-Pro/Flash等主流大模型一键式私有化部署,预置办公、编码等通用场景智能体,搭配智能体管控系统,可在小时级快速拉起企业级智能体服务。

笔者认为,华为Agent加速平台以极致软硬协同性能、全链路闭环安全为两大核心支撑,再辅以开箱即用的交付能力,为行业AI规模化、产业化落地筑牢坚实平台底座。

案例印证:千行万业,用起来才是硬道理

在展区内,一体机全系列产品与Agent加速平台的实操演示前围满了观众。相比参数,笔者更关注“用起来”的效果。

笔者与现场专家交流后了解到,华为一体机已在诸多行业落地。首先,在最讲规矩的金融与政务行业,某股份制银行将AI编程平台装进一体机、私有化部署后,AI评审自动拦截SQL注入、硬编码密钥等风险,发现率可达55%,补全采纳率达到72%,迭代周期从双周缩短至单周;某省级政务中心的30多个应用开发,采用一体机部署后,复杂需求从一两天压到两三小时。

其次,在3C电子产线上,质检曾是“人海战术”,一条产线需要6名工人肉眼抽检,漏检率高达12%。车间采用一体化AI质检整机后,可实现8路画面同步检测,检测精度达99.5%,推理时延低于100毫秒,产品漏检率降至0.3%以内,产线仅需1名工作人员复核即可。

最后,在城市出行方面,海外某核心城区路口密集、车流时空分布复杂,固定配时的信号灯总在早晚高峰“失灵”。交通管理部门基于一台路侧AI智算一体机,可实现端侧运行14B大模型,并实时汇聚视频流、雷达、地磁等多源数据,提前推演5至15分钟的拥堵演化。这套设备让路口平均等待时间降约17%,日延误指数降20%,城市拥堵率降15%至20%。

这些案例表明,华为一体机让算力走进千行万业不再是口号,而是可参照的路径。

笔者观察:算力“合身”,AI才能更快落地

从大会现场杨超斌的演讲,到展区的产品性能展示,从工作人员的介绍,到专家案例的分享,笔者发现一体机正在给算力产业,以及企业使用算力的方式带来新变化。

其一,算力供给正从大型智算中心的“军备竞赛”,走向面向业务的分层适配。过去衡量AI能力,先看谁的集群大。如今,算力像水电一样按需取用,AI落地才真正走进千行万业。

其二,华为交付的不再只是算力硬件,而是完整的Agent能力底座。依托系列化一体机+Agent 加速平台,华为把复杂的性能调优、内生安全、易用性能力沉淀到底座侧,将简单便捷留给合作伙伴与客户,让AI落地从一项繁重复杂的系统工程,转变为开箱即用的标准化交付。

其三,企业最该思考的一点是AI落地成败,关键不在“算力堆多高”,而在“算力合不合身”。量体裁衣,方能行稳致远。

很显然,华为做到了。正如杨超斌在演讲中所说,华为将坚持系统级创新,构筑系列化算力底座,开源开放,联合客户、伙伴和开发者共建生态,为世界提供新选择。

面向未来,华为一体机要做的,正是让算力像水电一样按需取用、开箱即用。