移动游戏玩家过去十年一直在追求三件事:主机级的画质、持续稳定的帧率,以及足够撑过一整场游戏的电池续航。遗憾的是,大多数时候这三件事只能选两样。高通的答案是,把AI直接塞进GPU的图形管线里。
这家公司近日公布了下一代骁龙旗舰平台所搭载的新一代Adreno GPU的技术细节,其中最核心的变化是首次引入了面向AI运算的专用矩阵核心——Adreno Matrix Cores。这组专用计算单元可以直接在GPU图形管线内部运行AI模型,使矩阵加速能力覆盖CPU、NPU和GPU三大计算单元,同时减少了神经网络任务在不同处理单元之间的迁移开销。一年前高通已经在CPU中加入矩阵运算技术,这次是把同样的思路延伸到了GPU。
基于Matrix Cores,高通推出了Adreno Neural Fusion技术。这是一项AI驱动的渲染技术,将神经网络处理、AI超级分辨率和AI帧生成整合到统一的图形管线中。通俗地说,游戏可以先用较低分辨率渲染画面,然后由AI在GPU内部直接完成画质提升和插帧,而无需把数据搬来搬去。与过去的方案相比,Adreno Neural Fusion在提供更高画质的同时能够大幅减少画面瑕疵、提升帧率稳定性,功耗最高可降低40%。
为了让AI计算跑得更快,高通还配备了18MB的Adreno高性能内存(HPM)。这是一块集成在芯片内部、专为图形处理服务的高速存储空间,可以在渲染过程中保存渲染目标、深度与颜色缓冲区、纹理等中间数据。开发者可根据不同图形负载灵活调用片上存储,减少数据反复前往系统内存所带来的延迟与功耗。高通公布的数据显示,这一设计可带来约12%的功耗改善。
从架构层面看,新一代Adreno GPU延续了三切片设计,每个切片的运行频率从1.2GHz提升到了1.45GHz。高通称这是Adreno历来幅度最大的一次架构升级,图形性能和能效表现都将得到提升。
对开发者来说,采用门槛同样关键。Adreno Neural Fusion目前已获得Unity和Unreal Engine两大主流游戏引擎的支持。游戏工作室无需开发自定义解决方案,即可直接获得开箱即得的画质和性能提升。高通称这是行业首个且已商用的、支持主流游戏引擎的移动端AI超级分辨率技术。首批支持该技术的游戏预计将在今年实现商业化落地。
高通向GPU中塞进专用AI核心这一步,其实是在追随整个行业的趋势——英伟达2017年在GPU里加入了Tensor Core,苹果2025年也在自家GPU中加入了Neural Accelerator。高通现在补上了这一环,骁龙平台的CPU、NPU、GPU三个核心引擎都有了矩阵加速能力。完整的GPU性能数据以及搭载该技术的游戏阵容,预计将在9月22日至24日举行的骁龙峰会上公布。