llama.cpp b11055发布:Hexagon后端新增GEGLU_QUICK支持
该版本唯一的代码变更是为Hexagon后端加入GEGLU_QUICK算子支持(PR #29114),同时照例放出覆盖macOS、Linux、Windows、Android和openEuler的预编译包。
AI解读:受影响的主要是想在高通Hexagon芯片上跑llama.cpp的人。GEGLU是不少现代大模型FFN层里用到的激活结构,加上这个算子的快速路径,意味着这部分计算有机会走Hexagon的加速通道,而不是回落。
不过来源没有给出任何性能数字、精度对比或适用机型,所以“快多少”暂时无从判断。预编译包里macOS的KleidiAI版本和openEuler系列仍标为DISABLED,下载前值得先确认自己需要的后端是否在列。
llama.cpp发布b11055版本,唯一的代码变更是为Hexagon后端新增GEGLU_QUICK支持,对应PR #29114。
发布说明由github-actions[bot] 生成,除这一行变更外,其余均为各平台预编译产物的下载链接。
唯一的代码变更:Hexagon后端支持GEGLU_QUICK
b11055的发布说明首行写明:hexagon: add support for GEGLU_QUICK(#29114)。这是该版本中来源文本唯一列出的代码级改动。
来源未说明该支持的实现细节、性能收益、精度影响,也未说明适用于哪些Hexagon型号或哪些模型架构。
预编译产物覆盖的平台与后端
发布页按平台列出了可下载的二进制包。
来源中部分条目标注为DISABLED:macOS Apple Silicon的KleidiAI enabled版本,以及openEuler的x86(310p)、x86(910b, ACL Graph)、aarch64(310p)、aarch64(910b, ACL Graph)均标记为DISABLED。
- macOS/iOS:Apple Silicon(arm64)、Intel(x64)、iOS XCFramework。
- Linux:Ubuntu x64/arm64/s390x(CPU)、Ubuntu x64与arm64(Vulkan)、Ubuntu x64(CUDA 12)、Ubuntu x64与arm64(CUDA 13)、Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO 2026.4)、Ubuntu x64(SYCL FP32与FP16)。
- Windows:x64与arm64(CPU)、arm64(OpenCL Adreno)、x64(CUDA 12)、x64与arm64(CUDA 13)、x64(Vulkan)、x64(OpenVINO 2026.4)、x64(SYCL)、x64(ROCm 10.0)。
- Android:arm64(CPU)。
- 其他:UI包。
- CUDA 12与CUDA 13分别附带对应的cudart库压缩包。