继不久前提前公布新款旗舰SoC的部分CPU设计后,9月2日晚间,高通再次披露了新一代旗舰平台的更多信息。
这一次他们的重点转向了游戏玩家、开发者可能更在乎的领域,也就是GPU。
沿用Adreno 800系架构,频率再次提高
众所周知,此前高通在骁龙8至尊版上,首次引入了带有硬件切片设计的Adreno 800系GPU。
到了即将今年秋季亮相的最新旗舰移动平台上,这一设计也得到了延续。高通方面公布的相关信息显示,新旗舰的GPU将继续使用三切片布局,但峰值主频比前代提升了250MHz。
需要注意的是,这里的对比对象是标准版的SM8850-AC,也就是说官方已经公布了新款旗舰SoC的GPU峰值频率达到了1200MHz+250MHz=1450MHz。
除此之外,按照高通方面的说法,新GPU将继续使用18MB的HPM(独立高速显存)。事实上,这个设计大家如今在PC的GPU上已经不陌生。
从本质上来说,这就是通过给GPU配备足够大的L2 Cache,从而降低GPU对内存带宽的需求,在游戏场景避免CPU和GPU争抢内存带宽。该技术此前在Adreno 830、Adreno 840上已经使用了两代,软件支持方面已然成熟,所以在新款旗舰SoC上沿用自然也很合理。高通方面公布的数据显示,18MB的HPM可以为新GPU带来额外12%的能效提升。
GPU核心数大概率没变,但加了新的功能单元
如果此前关注过一些爆料信息,可能就听过这样的一种说法,那就是高通会在新一代旗舰平台上显著提高GPU的流处理器规模,将切片数量翻倍,或是将每个切片内的算术逻辑单元数量翻倍。
但从目前官方公布的信息来看,新的Adreno旗舰GPU将沿用3切片设计。既然高通完全没提到GPU核心规模扩大,那么也就可以猜测,其大概率将依然沿用每切片512ALUs的配置,也就是总共1536ALUs,与前几代旗舰SoC的GPU方案基本相同。
那么这是否意味着,高通新款旗舰SoC的图形性能提升,就得靠更高的主频、更快的内存呢?
还真不是。因为新的GPU还是加入了新的硬件单元,这就是Adreno Matrix Cores(Adreno矩阵核心)。
熟悉PC GPU的朋友看到这里,可能又会觉得“眼熟”了。因为在Intel的GPU里,也有以“矩阵”命名的功能单元,那就是XMX(Xe Matrix Extensions)。而高通的“矩阵核心”在作用上,就如同其名称所示的那样,是新一代旗舰GPU里专门用于AI加速的独立核心。
首发原生GPU超分超帧,兼容性已做足准备
那么,Adreno Matrix Cores具体能起什么作用呢?
首先,它意味着新的Adreno GPU本身拥有了原生矩阵加速计算能力。对于需要同时调用CPU、NPU、GPU的复杂AI计算任务来说,它们能够仰赖的本地计算加速单元又多了一个。
其次,在前几代的骁龙平台上,曾经有厂商鼓捣出用NPU辅助GPU进行游戏画面超分超帧的技术。其实它本质上是用NPU充当了GPU“外挂AI加速器”的作用,从而实现高能效的原生游戏画面处理。
但是用NPU给GPU处理画面,就意味着数据必须先传输到芯片总线,进入NPU处理后再传回GPU。而这,自然就会增加额外的延迟。
相比之下,新款骁龙旗舰平台因为GPU加入了原生的矩阵核心,所以无需再借助NPU,就可以在GPU内部完成游戏超分和帧生成计算。而这就是高通全新的Adreno Neural Fusion技术。
最重要的是,与此前需要手机厂商自己鼓捣,去联系游戏开发商适配的方案不同,Adreno Neural Fusion作为新款旗舰平台的原生GPU画面处理技术,从一开始就得到了Unity和虚幻引擎等主流游戏引擎的支持。
因此无论是未来的游戏兼容性,还是画面处理效果,都会更值得期待。
不靠“堆核心”,高通的GPU设计思路值得参考
如果大家有关注最近这两年的手机市场,就会注意到一个有趣的现象。比起理论性能,高通的Adreno GPU这两年其实都未必能在同级别的产品里取得领先地位。
但真跑起游戏来,所有人都知道,只有“骁龙芯”的游戏帧率最高、兼容性最好。
为什么会这样?倒不是说其他友商在跑分上耍了什么滑头,而是因为高通很明显抓住了游戏优化技术的重点。比起单纯堆规格、堆跑分,与游戏引擎、游戏开发者深度合作,更充分地挖掘GPU的潜力、让每一个新的功能特性都最终落到实处,才是让终端设备“打游戏更顺”的真正诀窍。
热门跟贴