llama.cpp发布b11217:调整OpenCL二进内核加载条件
llama.cpp构建版本b11217发布,唯一列出的代码改动是优化OpenCL二进内核(bin kernel)的加载条件(PR #29503),同时提供覆盖macOS、Linux、Windows、Android的多平台二进制包。
AI解读:这条更新的实际代码改动只有一行说明:调整OpenCL二进内核的加载条件。OpenCL是llama.cpp在部分GPU(如高通Adreno)上跑推理的后端之一,二进内核指的是预先编译好、直接交给GPU驱动执行的kernel,而不是运行时再编译。改加载条件,通常是为了决定什么情况下用预编译版本、什么情况下回退,但发布说明没有给出具体判断逻辑,也没有性能数据。
如果你在用llama.cpp的OpenCL后端(Windows arm64的Adreno包、以及Snapdragon平台的Linux/Android构建),这个版本值得跟进;其他人基本可以跳过,等常规升级即可。需要说明的是,发布页只列了改动标题和下载包,没有附带基准测试或兼容性说明,所以无法判断它对速度或稳定性的实际影响。
llama.cpp发布了构建版本b11217。发布说明中列出的唯一代码改动是“opencl: refine bin kernel loading condition”,对应PR #29503,即优化OpenCL二进内核的加载条件。
b11217提供的平台与后端构建包
发布页按平台列出了可下载的二进制包。macOS/iOS侧包括macOS Apple Silicon (arm64)、macOS Intel (x64) 和iOS XCFramework;其中标注KleidiAI的macOS Apple Silicon构建显示为DISABLED,并链接到PR #23780。
Linux侧包括Ubuntu x64、arm64、s390x的CPU构建,Ubuntu x64/arm64的Vulkan构建,以及Ubuntu x64的CUDA 12(配CUDA 12.8库)、CUDA 13(配CUDA 13.4库)、ROCm 10.0、OpenVINO 2026.4、SYCL FP32与SYCL FP16构建;另有Ubuntu arm64的CUDA 13构建及对应CUDA 13.4库,以及附带CPU、Adreno GPU、Hexagon NPU的Linux arm64 Snapdragon包和安装指南。
Android侧提供arm64 CPU构建,以及带Snapdragon CPU、Adreno GPU、Hexagon NPU的arm64构建和安装指南。Windows侧提供x64与arm64的CPU构建,arm64的OpenCL Adreno构建,x64的CUDA 12(配CUDA 12.4 DLL)、CUDA 13(配CUDA 13.4 DLL)、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0构建,以及arm64的CUDA 13构建和对应DLL。
openEuler相关条目(x86 310p、x86 910b ACL Graph、aarch64 310p、aarch64 910b ACL Graph)在本次发布中显示为DISABLED,链接到PR #23705。此外还提供UI包。