llama.cpp发布b11312,修复WebGPU后端SSM_SCAN绑定别名问题
该版本主要包含一项WebGPU修复(#29750),同时为macOS、Linux、Windows、Android和openEuler等平台提供预编译包。
AI解读:这条修复面向使用WebGPU后端跑SSM(状态空间模型)类算子的场景。绑定别名通常意味着同一块GPU缓冲区被多个绑定同时引用,可能导致读取到错误数据;修复后这类冲突应当消除,但发布说明没有给出性能或正确性对比数据。
随版本照例提供了各平台预编译包,覆盖macOS/iOS、Linux、Windows、Android,包含CPU、CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL、OpenCL Adreno以及骁龙CPU/GPU/NPU等后端。
对普通用户来说,如果你不用WebGPU跑SSM类模型,这个版本没有必须升级的理由;使用该路径的开发者可以换到b11312验证问题是否消失。
发布页同时显示,macOS Apple Silicon的KleidiAI启用版和openEuler系列构建处于DISABLED状态,分别对应PR #23780 和 #23705。
llama.cpp发布b11312版本,变更日志只有一项:webgpu: fix SSM_SCAN binding aliasing(#29750)。
该修复针对WebGPU后端中SSM_SCAN算子的绑定别名问题。发布说明没有展开描述症状、影响范围或验证方式,只给出这一条提交标题。
版本照例附带各平台预编译产物:macOS Apple Silicon(arm64)与Intel(x64)、iOS XCFramework;Ubuntu x64/arm64/s390x的CPU构建,以及Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16构建。
Linux arm64还提供骁龙(Snapdragon)专用包,覆盖CPU、Adreno GPU、Hexagon NPU;Android arm64同样有CPU版和骁龙版。
Windows侧提供x64/arm64 CPU、arm64 OpenCL Adreno、CUDA 12.4、CUDA 13.4(x64与arm64)、Vulkan、OpenVINO、SYCL、ROCm 10.0构建。
发布页另注明macOS Apple Silicon的KleidiAI启用版处于DISABLED,openEuler的x86/aarch64构建(310p、910b ACL Graph)也标记为DISABLED。