llama.cpp b11045发布:Hexagon后端加入ROLL算子支持
llama.cpp发布b11045构建版本,唯一代码变更是为Hexagon后端添加ROLL算子支持(PR #29105),并同步更新全平台预编译包。
llama.cpp发布了构建版本b11045,其唯一的代码变更是为Hexagon后端添加ROLL算子支持,对应合并请求 #29105。
发布页面同时按新版本号更新了各平台的预编译产物,包括macOS/iOS、Linux、Windows、Android和UI构建。
发布信息没有包含该变更的性能数据、适用模型范围或正确性验证结果,因此只能确认算子层面的支持已经加入,无法判断实际推理收益。
这次合并改了什么
b11045的发布说明首行写明:hexagon: add ROLL op support (#29105)。也就是说,本次版本相对上一构建的代码差异,是为Hexagon后端补上ROLL算子。
Hexagon指高通Hexagon DSP相关的推理执行路径。此前若模型的计算图用到ROLL算子而该后端未实现,运行时可能回退到其他后端或无法执行;这次提交把该算子纳入Hexagon支持范围。
发布说明并未提供ROLL的具体语义说明、测试覆盖范围或基准测试结果。有关该提交的细节需查阅对应的PR #29105,本简讯仅依据发布摘要陈述。
- 变更内容:Hexagon后端新增ROLL算子支持
- 对应PR:#29105
- 发布说明中未附带性能或正确性数据
同步更新的预编译产物
与常规构建发布一样,b11045提供了覆盖多个平台与加速后端的预编译包,用户无需自行编译即可获取这一版本。
macOS/iOS方面提供macOS Apple Silicon(arm64)、macOS Intel(x64)和iOS XCFramework。其中macOS Apple Silicon的KleidiAI启用版标注为DISABLED,指向PR #23780。
Linux方面提供Ubuntu x64/arm64/s390x的纯CPU包,以及Ubuntu x64与arm64的Vulkan包;GPU相关包括Ubuntu x64的CUDA 12(含cudart 12.8)和CUDA 13(含cudart 13.3)、Ubuntu arm64的CUDA 13、Ubuntu x64的ROCm 10.0。此外还有Ubuntu x64的OpenVINO 2026.4,以及SYCL FP32与SYCL FP16包。
Windows方面提供x64与arm64的CPU包、arm64的OpenCL Adreno包、x64与arm64的CUDA 12.4与CUDA 13.4包及其DLL、x64的Vulkan、OpenVINO 2026.4、SYCL和ROCm 10.0包。Android提供arm64 CPU包。
openEuler条目整体标注为DISABLED,指向PR #23705,原本列出的x86(310p)、x86(910b, ACL Graph)、aarch64(310p)、aarch64(910b, ACL Graph)均未提供下载。发布页还单独提供UI包。
- macOS/iOS:Apple Silicon arm64、Intel x64、iOS XCFramework;Apple Silicon的KleidiAI版为DISABLED(PR #23780)
- Linux:Ubuntu x64/arm64/s390x CPU;x64、arm64 Vulkan;CUDA 12.8与CUDA 13.3(x64与arm64);ROCm 10.0;OpenVINO 2026.4;SYCL FP32/FP16
- Windows:CPU x64/arm64;OpenCL Adreno arm64;CUDA 12.4与 13.4 及DLL;Vulkan;OpenVINO 2026.4;SYCL;ROCm 10.0
- Android:arm64 CPU
- openEuler:全部DISABLED(PR #23705)