开源llama.cpp Releases·原文 2026年9月17日

llama.cpp发布b11011:修复SYCL后端split_buffer_type函数签名

这版构建的实质代码改动只有一条:#28981 修复了ggml_backend_sycl_split_buffer_type的函数签名,其余是各平台预编译包的常规更新。

AI解读:llama.cpp的b11011版本改了一行SYCL相关代码:修正ggml_backend_sycl_split_buffer_type的函数签名,对应PR #28981。这不是性能优化,也不是新模型支持,而是让接口声明与实际实现对齐。

受影响的只有走SYCL后端(Intel GPU等)编译或调用该函数的开发者。如果你只是下载官方预编译包跑模型,这次更新大概率感觉不到区别。

同步放出的二进制覆盖macOS、iOS、Linux、Android、Windows和openEuler,CUDA最高到 13.4、ROCm 10.0、OpenVINO 2026.3.1。KleidiAI加速的macOS包和openEuler包仍处于DISABLED状态,想要这些特性的用户暂时拿不到官方构建。

llama.cpp发布b11011版本,本次唯一的代码改动是修复SYCL后端函数签名:PR #28981 针对ggml_backend_sycl_split_buffer_type的函数签名进行了修正。

该版本同时发布了覆盖多平台的预编译二进制包,包括macOS、iOS、Linux、Android、Windows、openEuler,以及Web UI打包文件(llama-b11011-ui.tar.gz)。

预编译包覆盖范围

Linux侧提供Ubuntu x64/arm64/s390x的CPU构建、Vulkan构建(x64、arm64)、CUDA 12.8与CUDA 13.3的x64与arm64构建(含配套cudart库)、ROCm 10.0 x64、OpenVINO 2026.3.1 x64,以及SYCL FP32与FP16的x64构建。

Windows侧提供x64与arm64的CPU构建、arm64的OpenCL Adreno构建、CUDA 12.4与CUDA 13.4的x64构建、CUDA 13.4的arm64构建(均含对应cudart DLL)、Vulkan x64、OpenVINO 2026.3.1 x64、SYCL x64和ROCm 10.0 x64。

macOS提供Apple Silicon(arm64)与Intel(x64)两种构建,iOS提供XCFramework;Android提供arm64 CPU构建。

  • macOS Apple Silicon的KleidiAI加速构建标记为DISABLED
  • openEuler的x86(310p)、x86(910b, ACL Graph)、aarch64(310p)、aarch64(910b, ACL Graph)构建均标记为DISABLED

信息来源

llama.cpp Releases原始来源