开源llama.cpp Releases·原文 2026年9月28日

llama.cpp发布b11229:修复DKQ超过 256 mfma内核的模板跳过问题

该版本由llama.cpp Releases页面发布,标题为「HIP: fix template skip for DKQ > 256 mfma kernels (#29559)」,并同步提供多平台预编译包。

AI解读:llama.cpp发布了新构建版本b11229,发布说明中唯一列出的变更是「HIP: fix template skip for DKQ > 256 mfma kernels (#29559)」。这条信息来自GitHub上的llama.cpp Releases页面,属于该项目的自动构建产物发布。

按字面理解,这次修复针对的是HIP后端下DKQ超过 256 mfma内核时模板被跳过的问题。HIP是AMD GPU的并行计算接口,因此相关改动的受益者大概率是使用AMD显卡跑llama.cpp的用户;对于只用CPU、Metal或其他后端的用户,这个版本没有列出的行为变化。

不过发布说明只给出一行提交标题,没有附带复现条件、影响范围或性能数据。是否遇到该问题、是否需要升级,取决于使用者实际运行的模型与硬件配置,仅凭这一行说明无法判断修复前后的性能差异。

llama.cpp发布构建版本b11229,发布说明中列出的唯一变更为「HIP: fix template skip for DKQ > 256 mfma kernels (#29559)」。该信息来自llama.cpp Releases页面,属于项目自动构建发布的产物。

该版本随发布页面提供了面向各大平台的预编译包,包括macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Linux(Ubuntu x64/arm64/s390x的CPU、Vulkan、CUDA 12、CUDA 13、ROCm 10.0、OpenVINO、SYCL FP32/FP16构建,以及Snapdragon的CPU、Adreno GPU、Hexagon NPU构建)、Android(arm64 CPU与Snapdragon构建)、Windows(x64/arm64 CPU、OpenCL Adreno、CUDA 12、CUDA 13、Vulkan、OpenVINO、SYCL、ROCm 10.0)以及UI包。

发布说明还注明,macOS Apple Silicon的KleidiAI启用版本处于DISABLED状态,openEuler相关构建同样标记为DISABLED。

根据发布页面的标题,本次代码改动集中在HIP后端:修复DKQ超过 256 mfma内核时的模板跳过问题。发布说明未提供更多细节,例如受影响的具体内核、触发条件或性能数据。

信息来源

llama.cpp Releases原始来源