开源llama.cpp Releases·原文 2026年9月12日

llama.cpp b10929发布:为AMD GCN架构在HIP后端加专属配置表

llama.cpp发布b10929版本,核心变更是提交 #27841——在ggml-cuda的HIP路径中为AMD GCN架构新增专门的配置表,同时更新了覆盖macOS、Linux、Windows、Android等多平台的预编译产物。

AI解读:这次发布只有一个实质代码变更:为AMD GCN架构在HIP后端单独建了一张配置表。此前GCN大概率是和其他AMD架构共用一套参数,现在可以按自家特性调,属于针对性优化而非新功能。

直接受益的是用AMD显卡跑llama.cpp的人,尤其是GCN世代的老卡用户。不过发布说明没有给出任何性能数字或对比数据,实际提升幅度还无法从这份材料判断。

其余内容是多平台预编译包的例行更新,涵盖CUDA 12.4/13.3/13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 2026.3.1等后端。普通用户不需要立刻升级,等具体benchmark出来再决定更稳妥。

llama.cpp发布b10929版本,唯一实质代码变更是提交 #27841:在ggml-cuda的HIP路径中为AMD GCN架构新增专门的配置表。发布说明未附带性能数据或对比结果。

该版本同步更新了各平台预编译产物,覆盖macOS、iOS、Linux、Windows、Android与UI包。

HIP后端为AMD GCN单列配置表

本次发布的变更条目为“ggml-cuda: hip add specific config table for AMD GCN (#27841)”。按字面理解,这表示在ggml-cuda的HIP实现中,AMD GCN架构从原有的通用或共享配置中独立出来,改为使用专属的参数表。

发布说明仅给出这一条变更描述,没有说明配置表包含哪些参数、覆盖哪些具体GPU型号,也没有提供任何性能测试、吞吐或延迟数字。因此这次改动带来的实际影响无法从来源判断。

预编译产物覆盖的平台与后端

b10929的发布附件按平台分类提供。

macOS/iOS方面:macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework。其中“macOS Apple Silicon (arm64, KleidiAI enabled)”一项标注为DISABLED。

Linux方面:Ubuntu x64(CPU)、Ubuntu arm64(CPU)、Ubuntu s390x(CPU)、Ubuntu x64(Vulkan)、Ubuntu arm64(Vulkan)、Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO 2026.3.1)、Ubuntu x64(SYCL FP32)、Ubuntu x64(SYCL FP16)。

Windows方面:Windows x64(CPU)、Windows arm64(CPU)、Windows arm64(OpenCL Adreno)、Windows x64(CUDA 12.4,附CUDA 12.4 DLLs)、Windows x64(CUDA 13.3,附CUDA 13.3 DLLs)、Windows arm64(CUDA 13.4,附CUDA 13.4 DLLs)、Windows x64(Vulkan)、Windows x64(OpenVINO 2026.3.1)、Windows x64(SYCL)、Windows x64(ROCm 10.0)。

Android方面:Android arm64(CPU)。

openEuler方面:该系列整体标注为DISABLED,对应条目包括openEuler x86(310p)、openEuler x86(910b, ACL Graph)、openEuler aarch64(310p)、openEuler aarch64(910b, ACL Graph)。

此外还提供UI包。

  • macOS Apple Silicon的KleidiAI启用版本在b10929中为DISABLED状态
  • Ubuntu的OpenVINO与Windows的OpenVINO均标注版本 2026.3.1
  • ROCm 10.0同时提供Ubuntu x64与Windows x64两个平台的构建
  • openEuler相关构建全部为DISABLED

信息来源

llama.cpp Releases原始来源