开源llama.cpp Releases·原文 2026年9月16日

llama.cpp发布b10998:为Qwen4实验版加hc算子

llama.cpp新版本b10998的发布说明只有一行改动:qwen4exp: add hc ops (#28901),其余内容为各平台预编译包下载链接。

AI解读:这条更新本身的信息量很小:llama.cpp版本b10998加入了一组名为hc ops的算子,提交编号是 #28901,前缀qwen4exp表明它与Qwen4实验版相关。发布页没有解释这组算子算什么、支持哪种精度,也没有给出性能数据。

受影响的会是需要在llama.cpp上跑Qwen4实验版模型的人:如果模型依赖这些算子,这次更新才可能让它在本地推理时跑通;反之,用旧版或其他模型的人没有变化。

发布页同时列出macOS、Linux、Windows、Android、iOS以及CUDA、Vulkan、ROCm、SYCL、OpenVINO等后端预编译包,具体支持情况需以各下载项为准。

llama.cpp发布b10998版本,发布说明中列出的唯一改动是 "qwen4exp: add hc ops"(#28901)。发布页未提供该改动的进一步说明。

版本页面主要提供预编译包下载链接,覆盖macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Linux Ubuntu(x64/arm64/s390x CPU,Vulkan,CUDA 12.8与 13.3,ROCm 10.0,OpenVINO 2026.3.1,SYCL FP32/FP16)、Android arm64 CPU、Windows(x64/arm64 CPU,OpenCL Adreno,CUDA 12.4与 13.4,Vulkan,OpenVINO 2026.3.1,SYCL,ROCm 10.0)以及UI包。

macOS Apple Silicon的KleidiAI启用版本标注为DISABLED,并链接到PR #23780;openEuler相关构建同样标注DISABLED,链接到PR #23705,列出的目标包括x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)。

信息来源

llama.cpp Releases原始来源