llama.cpp发布b11208,修复hrm模型z_l_init权重的层放置问题
该版本改动集中在hrm模型的权重层放置,同时提供macOS、Linux、Windows、Android及Snapdragon平台预编译包。
llama.cpp发布b11208版本,主要改动为修复hrm模型z_l_init权重的层放置问题,对应PR编号 #29512。
修复内容与影响范围
该版本说明中列出的唯一代码改动是“hrm : fix layer placement of `z_l_init` weight (#29512)”。也就是说,这次发布把hrm模型中z_l_init权重放到了正确的层。权重层放置错误属于模型结构层面的问题,修复后hrm模型在llama.cpp上的加载与推理结果应与预期一致。
版本说明没有进一步解释该问题会导致什么具体现象,也没有提供受影响的模型规模或复现条件。
各平台预编译包与禁用项
b11208照常提供多平台预编译产物:macOS包含Apple Silicon(arm64)与Intel(x64)二进制,以及iOS XCFramework;Linux覆盖Ubuntu x64/arm64/s390x的CPU构建,以及Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32与FP16构建,另有Linux arm64的Snapdragon构建(CPU、Adreno GPU、Hexagon NPU)。
Android提供arm64 CPU与arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU)两个包,并附有Snapdragon设置指南。Windows覆盖x64与arm64的CPU、CUDA 12.4、CUDA 13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0,以及arm64的OpenCL Adreno构建。UI也提供单独的压缩包。
- macOS Apple Silicon的KleidiAI启用版标注为DISABLED,链接指向PR #23780。
- openEuler的x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)均标注为DISABLED,链接指向PR #23705。