llama.cpp发布b11399:CUDA swizzling代码重构并修复模板与循环边界
该版本由GitHub Actions自动发布,提交信息显示本次改动为CUDA swizzling代码重构,并修复了模板与循环边界;发布页同时提供macOS、Linux、Windows、Android等多平台构建包。
AI解读:同一提交信息还写明“fix templates/loop bounds”,即修复模板与循环边界问题;来源未给出性能或正确性验证数据。
发布页由github-actions[bot] 生成,附带各平台预编译产物,涵盖macOS、iOS、Linux、Android、Windows以及UI包。
macOS Apple Silicon的KleidiAI构建和openEuler构建在发布页中被标注为DISABLED,对应的链接仍保留但不可用。
CUDA构建分别针对CUDA 12(Linux 12.8、Windows 12.4)与CUDA 13.4,并单独提供对应版本的runtime库压缩包。
来源没有说明swizzling重构的具体动机、影响范围或性能变化,因此无法据此判断实际效果。
llama.cpp发布b11399版本。发布说明列出的代码改动为CUDA swizzling代码重构(PR #29612),同时修复模板与循环边界。
本次改动内容
版本b11399的发布说明仅包含一条提交记录:“CUDA: refactor swizzling code (#29612)”,其下标注“fix templates/loop bounds”。发布页由github-actions[bot] 生成。
来源未提供该重构的动机说明、受影响的内核范围,也没有附带基准测试或正确性验证数据。
- CUDA swizzling代码重构,关联PR #29612
- 同一提交修复模板与循环边界
- 发布页署名github-actions[bot]
- 未提供性能或结果数据
可下载的构建产物
发布页列出面向多个平台与后端的预编译包。macOS提供Apple Silicon(arm64)与Intel(x64)版本,另有iOS XCFramework。Linux覆盖Ubuntu x64、arm64、s390x,以及Vulkan、CUDA、ROCm 10.0、OpenVINO、SYCL(FP32/FP16)等后端,并包含Snapdragon平台(CPU、Adreno GPU、Hexagon NPU)构建。Windows覆盖x64与arm64,以及CUDA 12.4、CUDA 13.4、Vulkan、OpenCL Adreno、OpenVINO、SYCL、ROCm 10.0等版本。Android提供arm64通用版本与Snapdragon版本,另有单独的UI包。
- macOS:Apple Silicon arm64、Intel x64、iOS XCFramework
- Linux:Ubuntu x64/arm64/s390x,Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO、SYCL
- Windows:x64/arm64,CUDA 12.4、CUDA 13.4、Vulkan、OpenCL Adreno、OpenVINO、SYCL、ROCm 10.0
- Android:arm64通用版与Snapdragon版
- CUDA包附带单独的runtime库压缩包
- 提供独立UI包
被标注为不可用的构建
发布页中,macOS Apple Silicon的KleidiAI启用版标注为DISABLED,并链接到PR #23780。openEuler系列构建同样标注为DISABLED,并链接到PR #23705,包含openEuler x86(310p、910b ACL Graph)与aarch64(310p、910b ACL Graph)条目。
- macOS Apple Silicon KleidiAI版:DISABLED,关联PR #23780
- openEuler x86与aarch64各版本:DISABLED,关联PR #23705
- 这些条目的下载链接仍保留在页面中,但状态标注为禁用