继不久前提前公布新款旗舰 SoC 的部分 CPU 设计后,9 月 2 日晚间,高通再次披露了新一代旗舰平台的更多信息。
这一次他们的重点转向了游戏玩家、开发者可能更在乎的领域,也就是 GPU。
沿用 Adreno 800 系架构,频率再次提高
众所周知,此前高通在骁龙 8 至尊版上,首次引入了带有硬件切片设计的 Adreno 800 系 GPU。
到了即将今年秋季亮相的最新旗舰移动平台上,这一设计也得到了延续。高通方面公布的相关信息显示,新旗舰的 GPU 将继续使用三切片布局,但峰值主频比前代提升了 250MHz。
需要注意的是,这里的对比对象是标准版的 SM8850-AC,也就是说官方已经公布了新款旗舰 SoC 的 GPU 峰值频率达到了 1200MHz+250MHz=1450MHz。
除此之外,按照高通方面的说法,新 GPU 将继续使用 18MB 的 HPM(独立高速显存)。事实上,这个设计大家如今在 PC 的 GPU 上已经不陌生。
从本质上来说,这就是通过给 GPU 配备足够大的 L2 Cache,从而降低 GPU 对内存带宽的需求,在游戏场景避免 CPU 和 GPU 争抢内存带宽。该技术此前在 Adreno 830、Adreno 840 上已经使用了两代,软件支持方面已然成熟,所以在新款旗舰 SoC 上沿用自然也很合理。高通方面公布的数据显示,18MB 的 HPM 可以为新 GPU 带来额外 12% 的能效提升。
GPU 核心数大概率没变,但加了新的功能单元
如果此前关注过一些爆料信息,可能就听过这样的一种说法,那就是高通会在新一代旗舰平台上显著提高 GPU 的流处理器规模,将切片数量翻倍,或是将每个切片内的算术逻辑单元数量翻倍。
但从目前官方公布的信息来看,新的 Adreno 旗舰 GPU 将沿用 3 切片设计。既然高通完全没提到 GPU 核心规模扩大,那么也就可以猜测,其大概率将依然沿用每切片 512ALUs 的配置,也就是总共 1536ALUs,与前几代旗舰 SoC 的 GPU 方案基本相同。
那么这是否意味着,高通新款旗舰 SoC 的图形性能提升,就得靠更高的主频、更快的内存呢?
还真不是。因为新的 GPU 还是加入了新的硬件单元,这就是 Adreno Matrix Cores(Adreno 矩阵核心)。
熟悉 PC GPU 的朋友看到这里,可能又会觉得 " 眼熟 " 了。因为在 Intel 的 GPU 里,也有以 " 矩阵 " 命名的功能单元,那就是 XMX(Xe Matrix Extensions)。而高通的 " 矩阵核心 " 在作用上,就如同其名称所示的那样,是新一代旗舰 GPU 里专门用于 AI 加速的独立核心。
首发原生 GPU 超分超帧,兼容性已做足准备
那么,Adreno Matrix Cores 具体能起什么作用呢?
首先,它意味着新的 Adreno GPU 本身拥有了原生矩阵加速计算能力。对于需要同时调用 CPU、NPU、GPU 的复杂 AI 计算任务来说,它们能够仰赖的本地计算加速单元又多了一个。
其次,在前几代的骁龙平台上,曾经有厂商鼓捣出用 NPU 辅助 GPU 进行游戏画面超分超帧的技术。其实它本质上是用 NPU 充当了 GPU" 外挂 AI 加速器 " 的作用,从而实现高能效的原生游戏画面处理。
但是用 NPU 给 GPU 处理画面,就意味着数据必须先传输到芯片总线,进入 NPU 处理后再传回 GPU。而这,自然就会增加额外的延迟。
相比之下,新款骁龙旗舰平台因为 GPU 加入了原生的矩阵核心,所以无需再借助 NPU,就可以在 GPU 内部完成游戏超分和帧生成计算。而这就是高通全新的 Adreno Neural Fusion 技术。
最重要的是,与此前需要手机厂商自己鼓捣,去联系游戏开发商适配的方案不同,Adreno Neural Fusion 作为新款旗舰平台的原生 GPU 画面处理技术,从一开始就得到了 Unity 和虚幻引擎等主流游戏引擎的支持。
因此无论是未来的游戏兼容性,还是画面处理效果,都会更值得期待。
不靠 " 堆核心 ",高通的 GPU 设计思路值得参考
如果大家有关注最近这两年的手机市场,就会注意到一个有趣的现象。比起理论性能,高通的 Adreno GPU 这两年其实都未必能在同级别的产品里取得领先地位。
但真跑起游戏来,所有人都知道,只有 " 骁龙芯 " 的游戏帧率最高、兼容性最好。
为什么会这样?倒不是说其他友商在跑分上耍了什么滑头,而是因为高通很明显抓住了游戏优化技术的重点。比起单纯堆规格、堆跑分,与游戏引擎、游戏开发者深度合作,更充分地挖掘 GPU 的潜力、让每一个新的功能特性都最终落到实处,才是让终端设备 " 打游戏更顺 " 的真正诀窍。
加入收藏 点赞 ( 0 ) 踩 ( 0 )


登录后才可以发布评论哦
打开小程序可以发布评论哦