开源llama.cpp Releases·原文 2026年9月30日

llama.cpp b11277发布:为ggml-zdnn后端实现缓冲区重置并修复内存泄漏

该版本的主要代码变更来自PR #29637,为IBM zDNN后端实现缓冲区重置、修复内存泄漏,作者Aaron Teo同时修正了代码风格。

llama.cpp发布b11277版本,提交信息为“ggml-zdnn: impl buffer reset, fix memory leaks (#29637) cont: fix code style”,作者Aaron Teo(Signed-off-by: Aaron Teo)。

变更内容有两部分:为ggml-zdnn后端实现缓冲区重置(buffer reset),以及修复内存泄漏;提交说明中的“cont: fix code style”表示这是延续性的代码风格修正。

b11277附带的平台二进制

发布页列出各平台预编译产物:macOS提供Apple Silicon(arm64)和Intel(x64)版本,以及iOS XCFramework。macOS Apple Silicon的KleidiAI启用版本标记为DISABLED(对应PR #23780)。

Linux提供Ubuntu x64/arm64/s390x的CPU版本,以及Vulkan、CUDA 12(12.8)、CUDA 13(13.4)、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16版本,并单独提供CUDA 12.8与CUDA 13.4的运行时库;另有Linux arm64的Snapdragon版本,覆盖CPU、Adreno GPU、Hexagon NPU。

Android提供arm64 CPU版本和arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU)版本,均附有setup guide。Windows提供x64/arm64 CPU、arm64 OpenCL Adreno、x64 CUDA 12.4、CUDA 13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0版本,并单独提供CUDA 12.4与CUDA 13.4的DLL。

openEuler相关构建全部标记为DISABLED(对应PR #23705),包括x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)。发布页还提供独立的UI压缩包。

  • ggml-zdnn后端:实现缓冲区重置,修复内存泄漏(#29637),作者Aaron Teo
  • macOS KleidiAI启用版本:DISABLED
  • openEuler构建:DISABLED(#23705)
  • Windows/Linux均包含CUDA 12与CUDA 13两代构建
  • Android与Linux arm64提供Snapdragon CPU/Adreno GPU/Hexagon NPU版本

信息来源

llama.cpp Releases原始来源