开源llama.cpp Releases·原文 2026年9月17日本站收录 2026年9月18日

llama.cpp发布b11022:Vulkan后端缓冲区与调试代码拆分为独立文件

该版本把Vulkan后端的缓冲区代码和调试代码拆到单独文件并新增共享头文件,同时发布覆盖macOS、Windows、Linux、Android等平台的预编译包。

llama.cpp发布b11022版本,主要变更是将Vulkan后端的缓冲区(buffers)和调试代码拆分为独立文件,并新增共享头文件,对应PR #28732。

Vulkan后端拆分缓冲区与调试代码

发布信息的变更标题为“vulkan: split buffers and debug code into separate files, add shared headers (#28732)”。也就是把Vulkan后端里原本集中在一起的缓冲区相关代码和调试相关代码拆成单独文件,并引入共享头文件。

发布说明没有给出这一改动对性能、显存占用或兼容性的具体影响,只记录了改动标题和PR编号。

预编译产物覆盖的平台

b11022同时发布了一批预编译包,覆盖多个平台和加速后端。

  • macOS/iOS:macOS Apple Silicon (arm64)、macOS Intel (x64)、iOS XCFramework;macOS Apple Silicon的KleidiAI启用版被标记为DISABLED。
  • Linux:Ubuntu x64/arm64/s390x (CPU)、Ubuntu x64/arm64 (Vulkan)、Ubuntu x64 (CUDA 12.8)、Ubuntu x64/arm64 (CUDA 13.3)、Ubuntu x64 (ROCm 10.0)、Ubuntu x64 (OpenVINO 2026.3.1)、Ubuntu x64 (SYCL FP32与FP16),并附带对应CUDA运行时库。
  • Windows:x64/arm64 (CPU)、arm64 (OpenCL Adreno)、x64 (CUDA 12.4与CUDA 13.4)、arm64 (CUDA 13.4)、x64 (Vulkan、OpenVINO 2026.3.1、SYCL、ROCm 10.0),并附带对应CUDA DLL。
  • Android:arm64 (CPU)。UI:单独的UI包。
  • openEuler:x86 (310p)、x86 (910b, ACL Graph)、aarch64 (310p)、aarch64 (910b, ACL Graph) 四项均被标记为DISABLED。

发布信息中的限制

该发布条目由github-actions[bot] 生成,内容以变更标题和产物下载链接为主,没有附性能基准、回归测试结果或升级注意事项。

两个被标记为DISABLED的组合——macOS Apple Silicon的KleidiAI启用版和openEuler的全部构建——在本次发布中没有对应可用产物,依赖它们的用户无法直接从b11022获取预编译包。

信息来源

llama.cpp Releases原始来源