开源llama.cpp Releases·原文 2026年9月16日

llama.cpp发布b10992:llama-bench新增 --version打印构建信息

该版本由GitHub Actions自动发布,主要改动为llama-bench支持 --version参数以输出构建信息,同时提供覆盖macOS、Linux、Windows、Android、iOS与openEuler的预编译包。

AI解读:llama.cpp的b10992构建把llama-bench的 --version参数变成可用的功能:跑基准前可以先确认手里这个二进制到底是哪个构建,减少了版本对不上导致的排查成本。

对需要长期跟踪性能变化的开发者,这意味着基准数据可以附带明确的构建标识,换机器或换后端时更容易判断差异来自版本还是硬件。

不过这次改动只涉及版本信息打印,不改变模型推理速度或精度;预编译包是否更新到新版,仍取决于用户是否重新下载对应平台的文件。

普通用户不需要因为这一条做任何事;真正相关的是需要复现、对比llama-bench结果的开发者和性能测试人员。

llama.cpp发布b10992版本,该版本由GitHub Actions自动构建发布。

根据发布说明,这一版的主要改动是llama-bench支持 --version参数,用于打印构建信息(PR #28971)。

发布页同时列出了该版本在各平台的预编译产物,包括macOS、iOS、Linux、Android、Windows以及openEuler等平台。

llama-bench增加 --version输出构建信息

发布说明写明,b10992中的改动为“llama-bench: support --version to print build info”,对应PR #28971。

也就是说,用户可以在运行llama-bench时加上 --version,让工具打印构建信息,而不是只能进入基准测试流程。发布说明没有展开该参数输出的具体字段格式。

该版本提供的预编译产物

发布页按平台列出了b10992的构建产物。macOS/iOS部分包括macOS Apple Silicon (arm64)、macOS Intel (x64) 和iOS XCFramework;其中macOS Apple Silicon的KleidiAI enabled版本标注为DISABLED,并链接到PR #23780。

Linux部分包括Ubuntu x64、arm64、s390x的CPU版本,Ubuntu x64/arm64的Vulkan版本,Ubuntu x64的CUDA 12(附带CUDA 12.8 libraries)、CUDA 13(附带CUDA 13.3 libraries,含arm64)、ROCm 10.0、OpenVINO 2026.3.1以及SYCL FP32/FP16版本。

Android部分提供Android arm64 (CPU) 版本。Windows部分提供Windows x64/arm64 (CPU)、Windows arm64 (OpenCL Adreno)、Windows x64的CUDA 12(附带CUDA 12.4 DLLs)与CUDA 13(附带CUDA 13.4 DLLs,含arm64)、Vulkan、OpenVINO 2026.3.1、SYCL以及ROCm 10.0版本。

openEuler部分标注为DISABLED,并链接到PR #23705;列出的目标包括openEuler x86 (310p)、openEuler x86 (910b, ACL Graph)、openEuler aarch64 (310p)、openEuler aarch64 (910b, ACL Graph)。此外还提供单独的UI包。

  • macOS Apple Silicon (arm64) 存在,但KleidiAI enabled版本被标记为DISABLED(PR #23780)。
  • Linux覆盖CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL FP32/FP16。
  • Windows覆盖CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm 10.0。
  • Android仅列出Android arm64 (CPU)。
  • openEuler构建被标记为DISABLED(PR #23705)。
  • UI作为独立的tar.gz包提供。

信息来源

llama.cpp Releases原始来源