llama.cpp发布b11030:CI更新Android构建工具,多平台二进制同步放出
这次版本说明只有一条代码改动——把android-actions/setup-android升到 4.0.4,但随版本发布的预编译包覆盖macOS、iOS、Linux、Android、Windows及多种加速后端。
llama.cpp发布b11030版本。根据仓库发布说明,该版本记录的唯一代码提交是ci : bump android-actions/setup-android to 4.0.4(#29065),即把Android相关的GitHub Actions构建工具升级到 4.0.4。
预编译包覆盖的平台与后端
b11030的发布页附带了一批预编译二进制,按平台和加速后端分组。macOS/iOS方向提供macOS Apple Silicon arm64、macOS Intel x64以及iOS XCFramework;其中macOS Apple Silicon的KleidiAI enabled构建标注为DISABLED(关联PR #23780)。
Linux方向提供Ubuntu x64、arm64、s390x的CPU包,以及Vulkan(x64、arm64)、CUDA 12.8(x64)、CUDA 13.3(x64、arm64)、ROCm 10.0(x64)、OpenVINO 2026.4(x64)、SYCL FP32与FP16(x64)包。CUDA包同时单独提供对应版本的CUDA运行库压缩包。
- Android方向提供Android arm64(CPU)包。
- Windows方向提供x64/arm64 CPU包,以及OpenCL Adreno(arm64)、CUDA 12.4(x64)、CUDA 13.4(x64、arm64)、Vulkan(x64)、OpenVINO 2026.4(x64)、SYCL(x64)、ROCm 10.0(x64)包,CUDA包同样附带对应DLL。
- openEuler方向整体标注DISABLED(关联PR #23705),列出的条目包括openEuler x86 310p、openEuler x86 910b(ACL Graph)、openEuler aarch64 310p、openEuler aarch64 910b(ACL Graph)。
- 发布页另外提供独立的UI包。
这次改动的性质与适用人群
从发布说明看,b11030相对前一版本没有模型支持、算子或性能层面的变更说明,唯一可见改动是CI依赖升级,因此不改变llama.cpp的推理行为。依赖Android CI流水线或从源码构建Android目标的开发者会直接吃到这次改动;只下载预编译二进制运行本地模型的用户,包内容与上一版没有可感知差异。
需要避开的是被禁用的构建项:macOS arm64的KleidiAI构建与全部openEuler构建当前没有可用产物,对应的用户需要改用其他后端或平台包。