llama.cpp b11355发布:在 32KB共享内存的Samsung GPU上禁用Vulkan大型矩阵乘分块
该版本由llama.cpp发布频道发布,主要变更为Vulkan后端在共享内存为 32KB的三星GPU上禁用大型matmul tile,改动对应PR #28531,提交信息注明Assisted-by: Claude Op。
llama.cpp发布b11355版本,变更内容为:在共享内存为 32KB的Samsung GPU上,Vulkan后端禁用大型matmul tile(对应PR #28531)。该条提交信息注明Assisted-by: Claude Op。
发布页同时列出各平台构建产物,包括macOS Apple Silicon(arm64)与Intel(x64)、iOS XCFramework、Ubuntu x64/arm64/s390x(CPU)以及Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16等Linux构建,另有Linux arm64 Snapdragon包(CPU、Adreno GPU、Hexagon NPU)及对应安装指南。
发布页列出的构建产物
发布页按平台列出可下载文件:Android提供arm64(CPU)和arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU)两种包,并附Snapdragon设置指南链接。
Windows提供x64(CPU)、arm64(CPU)、arm64(OpenCL Adreno)、x64 CUDA 12(附CUDA 12.4 DLL)、x64/arm64 CUDA 13(附CUDA 13.4 DLL)、x64 Vulkan、x64 OpenVINO 2026.4、x64 SYCL与x64 ROCm 10.0等包。
发布页还列出UI包,以及openEuler的x86(310p)、x86(910b,ACL Graph)、aarch64(310p)、aarch64(910b,ACL Graph)条目;其中标注openEuler为DISABLED,并链接PR #23705。
被标注为禁用的构建
发布页中,macOS Apple Silicon(arm64, KleidiAI enabled)标注为DISABLED,链接到PR #23780;openEuler整个平台条目同样标注为DISABLED,链接到PR #23705。