开源llama.cpp Releases·原文 2026年9月18日

llama.cpp发布b11040:ggml新增显存分配失败检查以防崩溃

llama.cpp新版本b11040的核心改动是在ggml层检查内存分配失败,避免因分配失败直接崩溃;同步提供macOS、Linux、Windows、Android等平台预编译包,macOS KleidiAI加速版和openEuler构建处于禁用状态。

AI解读:llama.cpp发布了版本b11040,改动集中在ggml这一底层计算库:新增对内存分配失败的检查,目的是防止分配失败时程序直接崩溃。这是一个偏向稳定性的修补,而不是新模型或新功能。

对本地跑大模型的用户来说,这类改动通常不会带来速度变化,但会把“分配失败就闪退”变成可处理的错误路径,在显存或内存吃紧的低配设备上更有意义。具体行为仍取决于上层代码如何处理返回的错误。

发布页同时列出了各平台预编译包,包括macOS Apple Silicon和Intel、iOS XCFramework、Ubuntu的CPU/Vulkan/CUDA 12/CUDA 13/ROCm 10.0/OpenVINO/SYCL版本,以及Windows、Android版本。macOS的KleidiAI加速构建和openEuler构建标注为禁用。

llama.cpp发布了b11040版本,主要改动来自ggml模块:检查内存分配失败,以防止崩溃(对应PR #28149)。

该改动标题为“ggml : check for allocation failures to prevent crashes”,PR中还包含一处措辞调整。

随版本发布的预编译产物覆盖多个平台。macOS/iOS方面提供macOS Apple Silicon(arm64)、macOS Intel(x64)以及iOS XCFramework;其中macOS Apple Silicon的KleidiAI启用版本标注为DISABLED。

各平台预编译包与禁用项

Linux提供Ubuntu x64/arm64/s390x(CPU)、Ubuntu x64/arm64(Vulkan)、Ubuntu x64(CUDA 12,CUDA 12.8库)、Ubuntu x64/arm64(CUDA 13,CUDA 13.3库)、Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO 2026.4)、Ubuntu x64(SYCL FP32与FP16)。

Android提供Android arm64(CPU)。Windows提供x64/arm64(CPU)、arm64(OpenCL Adreno)、x64(CUDA 12.4及DLL)、x64/arm64(CUDA 13.4及DLL)、x64(Vulkan)、x64(OpenVINO 2026.4)、x64(SYCL)、x64(ROCm 10.0)。此外还提供UI包。

openEuler构建标注为DISABLED,列出openEuler x86(310p)、openEuler x86(910b,ACL Graph)、openEuler aarch64(310p)、openEuler aarch64(910b,ACL Graph)。发布页未说明禁用原因。

  • ggml检查内存分配失败,防止崩溃(PR #28149)
  • macOS KleidiAI启用版标注DISABLED(关联PR #23780)
  • openEuler构建标注DISABLED(关联PR #23705)

信息来源

llama.cpp Releases原始来源