llama.cpp b11167发布:Hexagon后端新增I32复制与拼接支持
llama.cpp发布b11167版本,主要变更是Hexagon后端支持I32类型的CPY和CONT操作,提交编号 #29379;同步更新各平台预编译包,其中macOS的KleidiAI加速版与openEuler构建仍处于禁用状态。
AI解读:这次更新本身很小:llama.cpp的Hexagon后端补上了I32数据类型的CPY(复制)和CONT(拼接)两种操作,改动对应PR #29379。Hexagon是高通骁龙芯片里的NPU,补齐这两个基础算子意味着在这类硬件上跑模型时,相关计算不再因缺少支持而回退或出错。
真正受影响的用户很具体:用骁龙设备(比如部分安卓手机、Windows on Arm笔记本,或Linux arm64小主机)跑llama.cpp、并想启用Hexagon NPU加速的人。对只在普通CPU或英伟达显卡上跑模型的用户,这个版本几乎没有可感知的变化。
另外两个细节值得留意:macOS Apple Silicon的KleidiAI加速构建和openEuler构建在本次发布中仍是禁用状态,说明这两条路径还没恢复。本次发布照例提供各平台预编译包,用户可以直接下载对应架构的二进制文件,不必自己编译。
llama.cpp发布b11167版本,本次代码变更是让Hexagon后端支持I32类型的CPY和CONT操作,对应PR #29379,提交由github-actions[bot] 生成,标注Assisted-by: OpenCode。
该版本按惯例提供多平台预编译二进制包,覆盖macOS/iOS、Linux、Android和Windows。其中部分构建条目处于禁用状态:macOS Apple Silicon(arm64)的KleidiAI加速版本标注DISABLED,并指向PR #23780;openEuler一栏也标注DISABLED,指向PR #23705。
各平台预编译包清单
发布页列出了b11167的全部下载产物,按平台分类如下。
- macOS/iOS:macOS Apple Silicon (arm64)、macOS Intel (x64)、iOS XCFramework;macOS Apple Silicon (arm64, KleidiAI enabled) 标注DISABLED。
- Linux:Ubuntu x64(CPU)、Ubuntu arm64(CPU)、Ubuntu s390x(CPU)、Ubuntu x64(Vulkan)、Ubuntu arm64(Vulkan)、Ubuntu x64(CUDA 12,含CUDA 12.8 libraries)、Ubuntu x64(CUDA 13,含CUDA 13.4 libraries)、Ubuntu arm64(CUDA 13,含CUDA 13.4 libraries)、Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO)、Ubuntu x64(SYCL FP32)、Ubuntu x64(SYCL FP16)。
- Linux arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU)单独提供,并附有setup guide。
- Android:Android arm64(CPU)、Android arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU),后者附setup guide。
- Windows:Windows x64(CPU)、Windows arm64(CPU)、Windows arm64(OpenCL Adreno)、Windows x64(CUDA 12,含CUDA 12.4 DLLs)、Windows x64(CUDA 13,含CUDA 13.4 DLLs)、Windows arm64(CUDA 13,含CUDA 13.4 DLLs)、Windows x64(Vulkan)、Windows x64(OpenVINO)、Windows x64(SYCL)、Windows x64(ROCm 10.0)。
- openEuler:整栏标注DISABLED,列出的目标包括openEuler x86 (310p)、openEuler x86 (910b, ACL Graph)、openEuler aarch64 (310p)、openEuler aarch64 (910b, ACL Graph)。
- UI:提供独立的UI打包文件。