开源llama.cpp Releases·原文 2026年9月30日

llama.cpp发布b11267:调整Vulkan GDN内核并修复Intel性能

该版本的主要代码变更是Vulkan后端:调优GDN着色器,并针对Intel平台修复性能问题(PR #29476)。发布页同时提供macOS、Linux、Windows、Android等多平台预编译包。

AI解读:llama.cpp发布了b11267版本,核心变更只有一条:调优Vulkan后端的GDN着色器,并修复在Intel平台上的性能表现,对应PR #29476。

这次改动落在Vulkan后端,而不是模型本身。对使用Vulkan推理路径、尤其是Intel显卡或核显的用户,这是直接影响运行效率的一次更新;不用Vulkan的人基本可以跳过。

发布页同时列出了各平台预编译包,Linux侧Vulkan构建对应Ubuntu x64和arm64。不过来源只给出变更标题与构建清单,没有公开测速数据,实际提升幅度无法从发布说明确认。

llama.cpp发布b11267。根据发布说明,该版本的主要代码变更是Vulkan后端:调优GDN着色器,并修复Intel平台上的性能问题,对应PR #29476。

发布页未给出性能对比数字,只列出构建产物清单。该版本提供macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Linux、Android、Windows以及UI的预编译包。

Vulkan后端的GDN着色器调优

发布说明把b11267的变更概括为“vulkan: Tune GDN kernel, fix Intel performance (#29476)”,并进一步拆成两点:调优GDN着色器,以及针对Intel进行调优。

这意味着修改发生在Vulkan后端的着色器代码层面,而非模型权重或量化方案。来源没有说明涉及的模型结构、测试条件或性能数字。

发布产物覆盖的平台

Vulkan构建在Linux侧提供Ubuntu x64与Ubuntu arm64两个包,Windows侧提供Windows x64(Vulkan)。

其余构建包括:macOS Apple Silicon arm64与macOS Intel x64、iOS XCFramework;Linux的CPU(x64、arm64、s390x)、CUDA 12.8/13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16、Snapdragon(CPU、Adreno GPU、Hexagon NPU);Android arm64的CPU与Snapdragon组合包;Windows的CPU、OpenCL Adreno、CUDA 12.4/13.4、OpenVINO、SYCL、ROCm 10.0;以及UI包。发布说明中macOS Apple Silicon的KleidiAI版本和openEuler相关构建标注为DISABLED。

  • Vulkan相关预编译包:Ubuntu x64、Ubuntu arm64、Windows x64
  • macOS/iOS:Apple Silicon arm64、Intel x64、iOS XCFramework
  • Linux另含CPU、CUDA 12.8/13.4、ROCm 10.0、OpenVINO 2026.4、SYCL、Snapdragon
  • Android含CPU与Snapdragon(CPU、Adreno GPU、Hexagon NPU)
  • Windows另含CPU、OpenCL Adreno、CUDA 12.4/13.4、OpenVINO、SYCL、ROCm 10.0

来源信息的边界

以上内容来自llama.cpp Releases页面b11267的发布说明,属于摘要性质:只有变更标题、链接和构建清单,没有附基准测试、PR讨论细节或Intel型号范围。

信息来源

llama.cpp Releases原始来源