开源llama.cpp Releases·原文 2026年9月24日

llama.cpp b11159发布:Vulkan后端修复conv_2d/conv_3d的misalignment问题

llama.cpp发布b11159构建版本,核心改动是在Vulkan后端处理conv_2d和conv_3d的对齐问题(PR #29365),同时修复test-backend-ops的打印输出。发布页附带了macOS、Linux、Windows、Android等多平台预编译包下载。

AI解读:这次更新是llama.cpp的一个常规构建发布(b11159),唯一实质性代码改动在Vulkan后端:让卷积算子conv_2d和conv_3d能够处理内存对齐不一致(misalignment)的情况。

它解决的是特定数据类型或张量布局在Vulkan上做二维、三维卷积时可能因地址不对齐而出错的问题,直接影响在Vulkan GPU上跑含卷积结构模型的用户。

除此之外只修了test-backend-ops的打印输出。发布页同时提供macOS、Linux、Windows、Android各平台的预编译二进制,其中部分后端(如macOS的KleidiAI、openEuler)仍处于禁用状态。

llama.cpp发布了b11159构建版本。根据发布说明,本次唯一的功能性改动是Vulkan后端处理conv_2d和conv_3d中的misalignment(内存对齐不一致)问题,对应PR #29365;同一提交还修复了test-backend-ops的打印输出。

Vulkan后端处理conv_2d与conv_3d的misalignment

发布说明显示,b11159的核心改动为“vulkan: handle misalignment in conv_2d and conv_3d (#29365)”。该提交让Vulkan后端在二维卷积(conv_2d)和三维卷积(conv_3d)算子执行时处理数据未对齐的情况。

同一提交包含“fix test-backend-ops print”,即修复后端算子测试(test-backend-ops)的打印输出。

发布包覆盖的平台

b11159的发布页附带各平台预编译产物链接,包括macOS Apple Silicon(arm64)与Intel(x64)、iOS XCFramework、Ubuntu(CPU的x64/arm64/s390x,以及Vulkan、CUDA 12、CUDA 13、ROCm 10.0、OpenVINO、SYCL FP32/FP16版本)、Linux arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU)、Android arm64(CPU及Snapdragon版本)、Windows(CPU的x64/arm64,OpenCL Adreno arm64,CUDA 12/13的x64/arm64,Vulkan,OpenVINO,SYCL,ROCm 10.0),以及独立的UI包。

  • macOS Apple Silicon(arm64,KleidiAI enabled)标注为DISABLED,链接指向PR #23780。
  • openEuler构建同样标注为DISABLED,链接指向PR #23705;列出但未提供下载的条目包括openEuler x86(310p)、openEuler x86(910b, ACL Graph)、openEuler aarch64(310p)、openEuler aarch64(910b, ACL Graph)。
  • Website与Attestations两项在发布说明中为空。

信息来源

llama.cpp Releases原始来源