开源llama.cpp Releases·原文 2026年9月18日

llama.cpp发布b11033:修复GGML_CPU=OFF且GGML_CUDA=ON时的构建失败

llama.cpp构建版本b11033修复了在关闭GGML_CPU、开启GGML_CUDA时CMake构建失败的问题,同时修正了convert-llama2c-to-ggml示例CMakeLists.txt的换行符。

AI解读:这次更新只解决一件事:当编译选项里GGML_CPU=OFF而GGML_CUDA=ON时,llama.cpp的CMake构建会失败。补丁修的就是这个组合。

受影响的是自己从源码编译、并且想只留CUDA后端的人。按原来那样配,编译直接报错;换成新版本重新跑一遍CMake就能过。

另一个改动只是清理examples/convert-llama2c-to-ggml/CMakeLists.txt的换行符,不涉及功能。官方同时照例放出了各平台预编译包,不想折腾编译的可以直接下载。

llama.cpp发布了构建版本b11033。该版本由github-actions[bot] 发布于项目Releases页面,提交信息显示,此次修复针对的是CMake构建在GGML_CPU=OFF且GGML_CUDA=ON时失败的问题(关联 #29026)。

同一提交还修正了examples/convert-llama2c-to-ggml/CMakeLists.txt文件中的行尾符(eol)。

修复内容与触发条件

提交说明写明两点:一是构建在GGML_CPU=OFF和GGML_CUDA=ON组合下失败,二是examples/convert-llama2c-to-ggml/CMakeLists.txt文件的行尾符被修正。

这是b11033唯一列出的代码变更内容,来源为llama.cpp Releases的发布说明。

  • CMake构建:GGML_CPU=OFF且GGML_CUDA=ON时失败,已修复(#29026)
  • examples/convert-llama2c-to-ggml/CMakeLists.txt:修正eol
  • 发布者为github-actions[bot],属于项目自动发布的构建版本

随版本发布的预编译包

该发布页同时列出了b11033的各平台二进制包,覆盖macOS/iOS、Linux、Android、Windows和openEuler,以及UI包。

其中macOS Apple Silicon的KleidiAI启用版与openEuler相关构建标注为DISABLED,并分别关联PR #23780 和 #23705。

  • macOS/iOS:Apple Silicon(arm64)、Intel(x64)、iOS XCFramework;Apple Silicon的KleidiAI启用版为DISABLED
  • Linux:Ubuntu x64/arm64/s390x(CPU)、Vulkan、CUDA 12.8、CUDA 13.3、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16,并附带CUDA运行时库包
  • Android:arm64(CPU)
  • Windows:x64/arm64(CPU)、arm64(OpenCL Adreno)、CUDA 12.4/13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0,并附带CUDA DLL包
  • openEuler:x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)均标注DISABLED

信息来源

llama.cpp Releases原始来源