开源llama.cpp Releases·原文 2026年10月1日

llama.cpp b11311发布:ggml-opencl后端用std::vector替换alloca()

该版本的核心改动来自署名Adrien Gallouët的提交(#29765),把ggml-opencl里的alloca() 换成std::vector;其余发布内容为各平台预编译包清单。

AI解读:这属于内存分配方式的调整,涉及OpenCL后端的栈分配写法,没有附带性能或正确性数据,因此改动效果无法从发布页判断。

真正受影响的只是使用OpenCL后端的构建者与下载对应二进制的人;发布页同时给出macOS、Linux、Windows、Android、openEuler及UI各组件的下载,并标注部分平台为DISABLED。

llama.cpp发布b11311版本,发布说明中列出的唯一代码改动是:ggml-opencl后端用std::vector替换alloca(),对应PR #29765,由Adrien Gallouët署名提交。

该条目位于发布页的改动说明位置;发布页其余内容为各平台构建产物与下载链接列表。

发布页同时标注了若干不可用项:macOS Apple Silicon(arm64,启用KleidiAI)为DISABLED,并指向PR #23780;openEuler相关条目为DISABLED,并指向PR #23705。

发布包覆盖的平台与后端

发布页按平台列出可下载的二进制包,覆盖macOS、iOS、Linux、Android、Windows、openEuler以及单独的UI组件。

Linux侧包含Ubuntu x64/arm64/s390x的CPU构建,以及Vulkan、CUDA 12(CUDA 12.8库)、CUDA 13(CUDA 13.4库)、ROCm 10.0、OpenVINO 2026.4、SYCL FP32与FP16构建;另有Linux arm64的Snapdragon包,标注支持CPU、Adreno GPU与Hexagon NPU。

Windows侧包含x64与arm64的CPU构建,arm64的OpenCL Adreno构建,以及CUDA 12.4、CUDA 13.4(含对应DLL)、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0构建。Android侧为arm64的CPU包与Snapdragon(CPU、Adreno GPU、Hexagon NPU)包。

macOS侧提供Apple Silicon(arm64)、macOS Intel(x64)与iOS XCFramework;openEuler条目包括x86(310p)、x86(910b,ACL Graph)、aarch64(310p)与aarch64(910b,ACL Graph),但这些条目均标注为DISABLED。

  • 核心改动:ggml-opencl用std::vector替换alloca(),PR #29765,Adrien Gallouët署名
  • macOS Apple Silicon(arm64,KleidiAI)标记为DISABLED,指向PR #23780
  • openEuler全部条目标记为DISABLED,指向PR #23705
  • Snapdragon包标注同时使用CPU、Adreno GPU与Hexagon NPU,并各自附带setup guide链接

信息来源

llama.cpp Releases原始来源