打开网易新闻 查看精彩图片

9月17日,芯展速以一场 AI 战略发布会,宣告「云-边-端」全景覆盖的AI战略布局正式落地。

当算力不再是瓶颈,症结在哪里?

发布会伊始,芯展速董事长兼CEO孙丹女士指出,GPU 算力二十年间增长近6万倍,而显存带宽与容量的增长却近乎线性——内存墙之下,主流解法似乎只剩下 KV Cache 压缩 + HBM 堆叠。

芯展速董事长兼 CEO 孙丹发表重要内容
打开网易新闻 查看精彩图片
芯展速董事长兼 CEO 孙丹发表重要内容

在这样的困局下,芯展速选择走出第三条创新的解法——让存储参与计算,以存力强化算力。构建「云、边、端」三级数据基座——云端 AI SSD 提升集群整体吞吐与稳定性、边缘 Token 工厂与实时推理、端侧本地化 AI 能力。

云侧, 芯展速副总裁李蓁VAST Data 中国区售前总监刘陈泓共同登台,现场发布了芯展速面向云端 AI 存储的全介质栈方案:SCM + 高密度 QLC + 高性能 TLC 的组合,这一方案已获得 VAST Data 官方认证。

芯展速副总裁 李蓁介绍芯展速全介质存储
打开网易新闻 查看精彩图片
芯展速副总裁 李蓁介绍芯展速全介质存储

边侧,芯展速副总裁许玮高级总监杨泽宏携 AI90 训推加速引擎亮相边侧发布环节。

AI90 训推加速引擎 Token吞吐提升效果
打开网易新闻 查看精彩图片
AI90 训推加速引擎 Token吞吐提升效果

许玮介绍了 AI90 Token 工厂智能 KV Cache 调度与智能 P2P 互联,以及将 KV Cache 从 HBM 卸载至高性能 AI SSD,构建 HBM +DRAM + SSD 三级存储体系——让「有限」显存承载「无限」上下文,消费级硬件跑出企业级性能。杨泽宏现场实测:推理吞吐量从约 120 tk/s 跃升至 610 tk/s,首 Token 延迟从27.99秒降至0.56秒——吞吐提升5倍,响应快50倍。

端侧,芯展速 AI30,将 AI SSD 引入端侧架构,配合端侧推理引擎 Herdsman 与混合模型策略,让 AI PC 可本地执行轻量任务、云端派发复杂推理、Auto 智能调度。

随后的圆桌对话以“算力平权:AI算力释放的下一个十年”为主题,芯展速副总裁金勤勇与产业链嘉宾同台论道,凝聚共识——存力正成为决定AI效率与价值的关键变量。

压轴环节,芯展速合伙人兼COO钱亚欧先后与光环新网、海威智算、云工厂、Flowy签署战略合作协议,宣布“云边端”生态闭环正式落地

当前,芯展速「云 - 边 - 端」生态版图已然完整展开,未来,芯展速将继续以「存—连—管」全栈独特优势,让「以存强算」走向纵深。