全x 86平台集体受益!AMD提交GCC扩展加载优化:Intel用户也能白嫖
2026年09月10日 15:54
快科技9月10日消息, AMD编译器团队近日向GCC提交了一项全新的扩展加载优化补丁,旨在改进“窄类型加载后接宽类型算术运算”场景下的代码生成质量。
AMD在补丁说明中指出,当代码涉及窄类型加载并随后进行宽类型算术运算时,GCC原本会生成使用vextract指令的代码,而实际上完全可以借助ZMM寄存器实现扩展加载,从而获得更优性能。
该补丁的核心实现是在SLP树中识别“加载+转换”模式。只要目标平台支持融合型加载扩展指令,就会将加载向量类型收窄为更窄的向量类型。
AMD强调,该补丁不会影响向量化成本计算,因为所有成本都不会基于旧的宽加载类型计算。在SLP操作成本首次记录时,就已经采用了收窄后的加载类型。
同时,收窄操作仅在加载在SLP图中被引用一次时才会触发,因此几乎不会产生意外副作用。全程不会修改SLP树结构和GIMPLE中间表示,仅更新一处SLP分析字段。
值得注意的是,这款补丁并不依赖任何Zen架构专属特性。 只要代码存在窄类型加载后接宽类型算术运算的场景,全系列x86_64架构都能从中受益。这意味着Intel处理器同样可以享受到这一优化带来的性能提升。
AMD编译器团队近年来在GCC和LLVM/Clang两大工具链上的投入持续加大。不仅提前将新Zen目标架构的编译器支持代码上游化,还开始投入更多精力开展通用编译器优化工作。
本次公开提交的补丁暂未附带性能测试数据,无法量化实际收益,但AMD在通用编译优化领域的持续投入仍值得肯定。
该补丁由AMD工程师Sridevi提交,目前正在审核中,有望被合入GCC 17正式版本。