开源llama.cpp Releases·原文 2026年10月2日

llama.cpp发布b11332,修复循环记忆模块中的无效断言

该版本的主要变更是修复recurrent memory中的无效断言(#29799),同时按惯例提供macOS、Linux、Windows、Android等多平台预编译包。

AI解读:版本同时按惯例提供了macOS/iOS、Linux、Windows、Android以及openEuler的预编译二进制包,覆盖CPU、CUDA 12/13、Vulkan、ROCm、SYCL、OpenVINO等后端。需要这些平台开箱即用二进制的用户可以下载对应压缩包。

对普通用户来说,如果正在用涉及循环记忆的模型(比如某些状态空间或循环结构模型),这个版本值得替换;如果只用常规Transformer模型,影响有限,是否升级取决于是否遇到相关断言崩溃。

注意macOS Apple Silicon的KleidiAI启用版和openEuler构建本版本处于DISABLED状态,需要这些特定构建的用户应留意上游说明。

llama.cpp发布构建版本b11332,变更日志列出的唯一代码修改是修复循环记忆模块中的无效断言,对应PR #29799。

该版本延续项目惯例,同步发布macOS/iOS、Linux、Windows、Android和openEuler的预编译包,覆盖CPU以及CUDA 12/13、Vulkan、ROCm、SYCL、OpenVINO等加速后端。

修复内容:recurrent memory中的无效断言

发布说明标题为“llama : fix invalid assert in recurrent memory (#29799)”,表示此次修复的是循环记忆路径中一个会被错误触发的断言。发布页未提供更多关于触发条件、影响模型或错误表现的技术细节。

各平台预编译包清单

发布页按平台列出了可供下载的预编译产物,方便不自行编译的用户直接取用。

  • macOS/iOS:macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework;macOS Apple Silicon的KleidiAI启用版标记为DISABLED。
  • Linux:Ubuntu x64/arm64/s390x(CPU)、x64与arm64的Vulkan、CUDA 12.8、CUDA 13.4(x64与arm64,含对应cudart库)、ROCm 10.0、OpenVINO 2026.4、SYCL FP32与FP16,以及Snapdragon(CPU、Adreno GPU、Hexagon NPU)和配套安装指南。
  • Android:Android arm64(CPU)与Snapdragon版(CPU、Adreno GPU、Hexagon NPU),附安装指南。
  • Windows:x64/arm64(CPU)、arm64 OpenCL Adreno、CUDA 12.4与 13.4(x64与arm64,含DLL)、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0。
  • openEuler:x86与aarch64上的 310p、910b(ACL Graph)构建均标记为DISABLED。
  • 另有独立的UI包可供下载。

信息来源

llama.cpp Releases原始来源