llama.cpp b11067发布:WebGPU后端加入融合GDN与拷贝算子
这版构建的唯一功能变更是WebGPU后端新增fused gdn + cpy(PR #28976),其余为各平台预编译包的常规更新。
llama.cpp发布b11067版本,发布说明列出的唯一功能变更是WebGPU后端新增融合的GDN与cpy算子,对应PR #28976。
除此之外,该页面内容为各平台预编译产物的下载清单,涵盖macOS/iOS、Linux、Windows、Android、openEuler与Web UI构建。
WebGPU后端新增fused gdn + cpy(PR #28976)
发布说明开头的变更条目为“webgpu : add fused gdn + cpy (#28976)”。这说明本次改动发生在WebGPU后端,新增了将GDN与cpy融合的算子。
发布说明没有提供该改动的性能数据、适用模型范围或测试结果,因此其实际收益和生效条件无法从这版说明中确认。
- 变更条目:webgpu : add fused gdn + cpy (#28976)
- 作用范围:WebGPU后端
- 发布说明未给出速度对比、支持模型列表或基准数据
各平台构建产物清单
b11067页面提供了macOS/iOS、Linux、Windows、Android、openEuler与Web UI的预编译包下载。发布者未在页面中标注本次构建与上一版之间的其他代码差异。
- macOS/iOS:Apple Silicon arm64、Intel x64、iOS XCFramework;Apple Silicon的KleidiAI版本标注为DISABLED(关联PR #23780)
- Linux:Ubuntu x64/arm64/s390x CPU,Ubuntu x64/arm64 Vulkan,Ubuntu x64 CUDA 12(12.8)与CUDA 13(13.3)、含对应CUDA运行库,Ubuntu x64 ROCm 10.0,Ubuntu x64 OpenVINO 2026.4,Ubuntu x64 SYCL FP32/FP16
- Windows:x64/arm64 CPU,arm64 OpenCL Adreno,x64 CUDA 12(12.4)与CUDA 13(13.4)、含对应DLL,arm64 CUDA 13(13.4)、含DLL,x64 Vulkan,x64 OpenVINO 2026.4,x64 SYCL,x64 ROCm 10.0
- Android:arm64 CPU
- openEuler:整体标注为DISABLED(关联PR #23705),列出x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)
- 其他:单独提供UI构建包(llama-b11067-ui.tar.gz)