llama.cpp发布b10991:为Hexagon恢复缺失的连续内存快速路径与hvx_copy_uu
该版本由GitHub Actions机器人发布,主要变更是为高通Hexagon后端重新加入此前缺失的连续内存快速路径,以及每次运行所需的hvx_copy_uu。
AI解读:这是一次常规构建版本更新,改动集中在一个具体的后端问题上:Hexagon的连续内存快速路径和hvx_copy_uu之前缺失,现在被补回。
Hexagon是高通芯片上的计算单元,llama.cpp通过它让手机等设备跑本地模型;快速路径缺失通常意味着数据要绕路拷贝,补回它是为了减少这种额外开销。
普通用户不需要立即做什么,受影响的主要是自己编译或指定Hexagon后端的开发者;官方按平台提供的预编译包不涉及Hexagon专属变体。
llama.cpp发布构建版本b10991,唯一列出的代码变更是为高通Hexagon后端重新加入缺失的连续内存快速路径(contiguous fast-path),以及每次运行所需的hvx_copy_uu,对应合并请求 #28886。
发布信息由GitHub Actions机器人(github-actions[bot])在llama.cpp Releases页面生成,除上述Hexagon改动外,正文其余部分是各平台预编译产物与库文件的下载清单。
改动内容与对应提交
版本b10991的发布说明标题为“hexagon: add back missing contiguous fast-path and hvx_copy_uu for each run”,即“为每次运行加回缺失的连续内存快速路径和hvx_copy_uu”,关联PR #28886。
这是该版本列出的唯一功能性变更描述;发布页面没有提供性能数据、基准测试或该改动对具体模型推理速度的影响说明。
- 变更对象:Hexagon后端
- 变更内容:恢复contiguous fast-path与hvx_copy_uu
- 关联PR:#28886
- 发布主体:llama.cpp Releases
随版本提供的构建产物
发布页面按平台列出了b10991的预编译包和配套库文件,覆盖macOS/iOS、Linux、Android与Windows。除CPU版本外,还包括Vulkan、CUDA 12、CUDA 13、ROCm 10.0、OpenVINO 2026.3.1、SYCL(FP32/FP16)以及OpenCL Adreno等后端变体,并单独提供UI压缩包。
两个条目在发布说明中被标记为DISABLED:macOS Apple Silicon的KleidiAI启用版(指向PR #23780),以及openEuler构建(指向PR #23705)。openEuler下列出的x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)因此均未随该版本提供。
- Windows:CPU x64/arm64、OpenCL Adreno arm64、CUDA 12.4、CUDA 13.4(x64与arm64)、Vulkan、OpenVINO、SYCL、ROCm 10.0
- Linux/Ubuntu:CPU(x64、arm64、s390x)、Vulkan、CUDA 12.8、CUDA 13.3、ROCm 10.0、OpenVINO 2026.3.1、SYCL FP32/FP16
- macOS/iOS:Apple Silicon arm64、Intel x64、iOS XCFramework
- Android:arm64 CPU
- 其他:UI压缩包;KleidiAI版与openEuler版标注为DISABLED