开源llama.cpp Releases·原文 2026年9月20日

llama.cpp b11055发布:Hexagon后端新增GEGLU_QUICK支持

该版本唯一的代码变更是为Hexagon后端加入GEGLU_QUICK算子支持(PR #29114),同时照例放出覆盖macOS、Linux、Windows、Android和openEuler的预编译包。

AI解读:受影响的主要是想在高通Hexagon芯片上跑llama.cpp的人。GEGLU是不少现代大模型FFN层里用到的激活结构,加上这个算子的快速路径,意味着这部分计算有机会走Hexagon的加速通道,而不是回落。

不过来源没有给出任何性能数字、精度对比或适用机型,所以“快多少”暂时无从判断。预编译包里macOS的KleidiAI版本和openEuler系列仍标为DISABLED,下载前值得先确认自己需要的后端是否在列。

llama.cpp发布b11055版本,唯一的代码变更是为Hexagon后端新增GEGLU_QUICK支持,对应PR #29114。

发布说明由github-actions[bot] 生成,除这一行变更外,其余均为各平台预编译产物的下载链接。

唯一的代码变更:Hexagon后端支持GEGLU_QUICK

b11055的发布说明首行写明:hexagon: add support for GEGLU_QUICK(#29114)。这是该版本中来源文本唯一列出的代码级改动。

来源未说明该支持的实现细节、性能收益、精度影响,也未说明适用于哪些Hexagon型号或哪些模型架构。

预编译产物覆盖的平台与后端

发布页按平台列出了可下载的二进制包。

来源中部分条目标注为DISABLED:macOS Apple Silicon的KleidiAI enabled版本,以及openEuler的x86(310p)、x86(910b, ACL Graph)、aarch64(310p)、aarch64(910b, ACL Graph)均标记为DISABLED。

  • macOS/iOS:Apple Silicon(arm64)、Intel(x64)、iOS XCFramework。
  • Linux:Ubuntu x64/arm64/s390x(CPU)、Ubuntu x64与arm64(Vulkan)、Ubuntu x64(CUDA 12)、Ubuntu x64与arm64(CUDA 13)、Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO 2026.4)、Ubuntu x64(SYCL FP32与FP16)。
  • Windows:x64与arm64(CPU)、arm64(OpenCL Adreno)、x64(CUDA 12)、x64与arm64(CUDA 13)、x64(Vulkan)、x64(OpenVINO 2026.4)、x64(SYCL)、x64(ROCm 10.0)。
  • Android:arm64(CPU)。
  • 其他:UI包。
  • CUDA 12与CUDA 13分别附带对应的cudart库压缩包。

信息来源

llama.cpp Releases原始来源