llama.cpp发布b10992:llama-bench新增 --version打印构建信息
该版本由GitHub Actions自动发布,主要改动为llama-bench支持 --version参数以输出构建信息,同时提供覆盖macOS、Linux、Windows、Android、iOS与openEuler的预编译包。
AI解读:llama.cpp的b10992构建把llama-bench的 --version参数变成可用的功能:跑基准前可以先确认手里这个二进制到底是哪个构建,减少了版本对不上导致的排查成本。
对需要长期跟踪性能变化的开发者,这意味着基准数据可以附带明确的构建标识,换机器或换后端时更容易判断差异来自版本还是硬件。
不过这次改动只涉及版本信息打印,不改变模型推理速度或精度;预编译包是否更新到新版,仍取决于用户是否重新下载对应平台的文件。
普通用户不需要因为这一条做任何事;真正相关的是需要复现、对比llama-bench结果的开发者和性能测试人员。
llama.cpp发布b10992版本,该版本由GitHub Actions自动构建发布。
根据发布说明,这一版的主要改动是llama-bench支持 --version参数,用于打印构建信息(PR #28971)。
发布页同时列出了该版本在各平台的预编译产物,包括macOS、iOS、Linux、Android、Windows以及openEuler等平台。
llama-bench增加 --version输出构建信息
发布说明写明,b10992中的改动为“llama-bench: support --version to print build info”,对应PR #28971。
也就是说,用户可以在运行llama-bench时加上 --version,让工具打印构建信息,而不是只能进入基准测试流程。发布说明没有展开该参数输出的具体字段格式。
该版本提供的预编译产物
发布页按平台列出了b10992的构建产物。macOS/iOS部分包括macOS Apple Silicon (arm64)、macOS Intel (x64) 和iOS XCFramework;其中macOS Apple Silicon的KleidiAI enabled版本标注为DISABLED,并链接到PR #23780。
Linux部分包括Ubuntu x64、arm64、s390x的CPU版本,Ubuntu x64/arm64的Vulkan版本,Ubuntu x64的CUDA 12(附带CUDA 12.8 libraries)、CUDA 13(附带CUDA 13.3 libraries,含arm64)、ROCm 10.0、OpenVINO 2026.3.1以及SYCL FP32/FP16版本。
Android部分提供Android arm64 (CPU) 版本。Windows部分提供Windows x64/arm64 (CPU)、Windows arm64 (OpenCL Adreno)、Windows x64的CUDA 12(附带CUDA 12.4 DLLs)与CUDA 13(附带CUDA 13.4 DLLs,含arm64)、Vulkan、OpenVINO 2026.3.1、SYCL以及ROCm 10.0版本。
openEuler部分标注为DISABLED,并链接到PR #23705;列出的目标包括openEuler x86 (310p)、openEuler x86 (910b, ACL Graph)、openEuler aarch64 (310p)、openEuler aarch64 (910b, ACL Graph)。此外还提供单独的UI包。
- macOS Apple Silicon (arm64) 存在,但KleidiAI enabled版本被标记为DISABLED(PR #23780)。
- Linux覆盖CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL FP32/FP16。
- Windows覆盖CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm 10.0。
- Android仅列出Android arm64 (CPU)。
- openEuler构建被标记为DISABLED(PR #23705)。
- UI作为独立的tar.gz包提供。