7月17日,2026世界人工智能大会(WAIC)在上海世博展览馆开幕。中科曙光展台,迎来了本届大会最受瞩目的展品之一——曙光8000(登峰)十万卡AI超集群真机。
这是国内首套全国产十万卡AI超集群首次公开展出,开展当日即获评大会官方“镇馆之宝”。
开展次日,中科曙光公布了曙光8000接入超算互联网后的最新运行数据:正式上线首周即实现满载运行,目前日均处理作业数突破15万个,单日处理作业峰值超过50万个。
十万卡规模不是简单堆叠,而是一项系统工程
在算力需求持续攀升的当下,单一节点的性能提升已难以满足前沿AI与科学计算的复合需求。十万卡级别的算力规模,考验的不是单一硬件的性能指标,而是从芯片互连、存储吞吐、散热供电到调度平台的全链路协同能力。
曙光8000(登峰)自设计之初便面向真实应用场景,采用“超智融合”体系结构,将芯片、计算、存储、网络、散热、应用、服务纳入一体化设计框架。系统完整支持FP64/FP32/BF16/TF32/FP8/INT8全计算精度,既能承载高精度科学工程计算,也能高效支撑大模型训练与AI推理,一站式适配混合精度复合业务需求。上线首周即实现满载运行,反映出科研机构、企业和开发者对超大规模、高质量算力的现实需求正在加速释放,同时也证明十万卡级算力已开始持续承接更加广泛的科研和产业任务。
全链路自主技术体系支撑高负载稳定运行
满载运行并不意味着资源拥堵。曙光8000依托智能化算力管理平台Gridview 7.0的MetaStack+K8s双融合调度架构,以及科研与运维双智能体协同机制,能够根据任务类型、数据位置和资源状态进行智能分流和按需调配。系统在高负载状态下仍可保持运行畅通,持续支撑大模型训练和高通量推理等复杂应用。
硬件层面,曙光8000的整体技术实力同样经得起检验。在计算密度方面,系统采用全球首创的高密度机柜结构,通过超高速正交架构、全电互连、浸没相变液冷及高效供电等系统工程技术,使单个计算单元算力密度较传统方案提升20倍。
在互连网络方面,自研scaleFabric类IB原生RDMA无损高速互连技术,无需依赖光通讯即可实现十万卡规模超高速稳定互连,单子网支持11.4万卡规模,网卡端到端时延低于1微秒,交换机转发时延仅260纳秒,并具备毫秒级链路故障自愈能力,网络稳定性不随集群规模扩张而衰减。
存储方面,配套ParaStor分布式存储系统已在2026年IO500榜单中斩获生产型全节点及10节点双料全球第一,确保海量数据的高效流转。
散热与供电方面,浸没相变液冷+湖水冷却双散热方案搭配高压直流高效供电系统,使全年自然冷却PUE低至1.04,能耗管控达到行业领先水平。
依托超算互联网加速算力普惠,三大计划共建产业生态
曙光8000已作为核心节点接入超算互联网,为全国用户提供高质量算力服务。截至目前,超算互联网平台注册用户超过140万,月均访问量突破1130万,累计完成作业2.4亿个。曙光8000的加入,使平台的日均处理作业数突破45万个。平台已适配1600余个开源大模型、600余个镜像、690余个数据集,形成了涵盖算力、模型、数据、应用的完整资源体系。
为进一步推动高端算力的普惠化使用,中科曙光同步推出三大生态共建计划。
“十万卡共创者激励计划”面向高校科研团队、科创企业及行业研发机构,开放阶梯式算力补贴和专属调度资源倾斜,针对AI for Science、行业大模型等标杆项目提供万卡级专属算力配额及全流程技术支持。
“智能体生态共创与招募计划”基于平台现有的276个科学智能体资产,面向AI开发者与算法团队开放多智能体协同框架与标准化测试环境,共同推动覆盖200余个细分科研任务的智能体生态建设。
“核心生态伙伴招募计划”则面向芯片、硬件设备、行业软件等全产业链厂商,提供全域流量曝光、联合技术认证及全国渠道推广资源,加速国产算力全产业链协同成熟。
从“建得成”到“用得好”,为国产算力探索新路径
曙光8000的首周满载运行、近千项超智融合应用适配,以及高负载状态下的持续稳定服务能力表明,超大规模AI基础设施的评价重点正在由单一的系统规模转向实际的服务能力与运营成效。
曙光8000用可验证的运行数据证明了十万卡级全国产算力集群不仅“建得成”,更“用得好、服务广、可复制”。这一实践样本的持续深化,将为国产超大规模算力基础设施从重大工程走向公共服务提供更为清晰的技术路线与运营范式。
热门跟贴