llama.cpp b11311发布:ggml-opencl后端用std::vector替换alloca()
该版本的核心改动来自署名Adrien Gallouët的提交(#29765),把ggml-opencl里的alloca() 换成std::vector;其余发布内容为各平台预编译包清单。
AI解读:这属于内存分配方式的调整,涉及OpenCL后端的栈分配写法,没有附带性能或正确性数据,因此改动效果无法从发布页判断。
真正受影响的只是使用OpenCL后端的构建者与下载对应二进制的人;发布页同时给出macOS、Linux、Windows、Android、openEuler及UI各组件的下载,并标注部分平台为DISABLED。
llama.cpp发布b11311版本,发布说明中列出的唯一代码改动是:ggml-opencl后端用std::vector替换alloca(),对应PR #29765,由Adrien Gallouët署名提交。
该条目位于发布页的改动说明位置;发布页其余内容为各平台构建产物与下载链接列表。
发布页同时标注了若干不可用项:macOS Apple Silicon(arm64,启用KleidiAI)为DISABLED,并指向PR #23780;openEuler相关条目为DISABLED,并指向PR #23705。
发布包覆盖的平台与后端
发布页按平台列出可下载的二进制包,覆盖macOS、iOS、Linux、Android、Windows、openEuler以及单独的UI组件。
Linux侧包含Ubuntu x64/arm64/s390x的CPU构建,以及Vulkan、CUDA 12(CUDA 12.8库)、CUDA 13(CUDA 13.4库)、ROCm 10.0、OpenVINO 2026.4、SYCL FP32与FP16构建;另有Linux arm64的Snapdragon包,标注支持CPU、Adreno GPU与Hexagon NPU。
Windows侧包含x64与arm64的CPU构建,arm64的OpenCL Adreno构建,以及CUDA 12.4、CUDA 13.4(含对应DLL)、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0构建。Android侧为arm64的CPU包与Snapdragon(CPU、Adreno GPU、Hexagon NPU)包。
macOS侧提供Apple Silicon(arm64)、macOS Intel(x64)与iOS XCFramework;openEuler条目包括x86(310p)、x86(910b,ACL Graph)、aarch64(310p)与aarch64(910b,ACL Graph),但这些条目均标注为DISABLED。
- 核心改动:ggml-opencl用std::vector替换alloca(),PR #29765,Adrien Gallouët署名
- macOS Apple Silicon(arm64,KleidiAI)标记为DISABLED,指向PR #23780
- openEuler全部条目标记为DISABLED,指向PR #23705
- Snapdragon包标注同时使用CPU、Adreno GPU与Hexagon NPU,并各自附带setup guide链接