llama.cpp b11352发布:优化qwen4exp的mask构造,并同步到GLM5-next
该版本的核心改动是qwen4exp的mask构造优化,同一改动也被应用到GLM5-next;发布页同时提供了macOS、Linux、Windows、Android等平台的预编译包。
llama.cpp发布b11352版本。根据发布页信息,该版本包含一个针对qwen4exp的改动:优化mask构造(optimize mask constructions,PR #29824)。
提交说明还提到,同一项改动被继续应用到了GLM5-next(cont : apply the same change for GLM5-next)。
发布页未给出该优化的性能数据、基准测试结果或适用条件,也没有说明是否影响其他模型。
除代码改动外,该版本照常提供各平台预编译包,覆盖macOS/iOS、Linux、Windows、Android等平台,并包含CUDA、Vulkan、ROCm、OpenVINO、SYCL等多种后端。
其中macOS Apple Silicon(arm64)的KleidiAI启用版本标注为DISABLED,openEuler相关构建同样标注为DISABLED。
以上信息来自llama.cpp Releases的发布页面摘要,未涉及完整变更日志或测试细节。