开源llama.cpp Releases·原文 2026年9月19日

llama.cpp发布b11049版本,为架构测试生成虚拟测试词表

该版本构建覆盖macOS、Linux、Windows、Android等平台,并提供CUDA、Vulkan、ROCm、OpenVINO、SYCL等多种后端二进制包;macOS KleidiAI与openEuler构建当前处于禁用状态。

AI解读:llama.cpp的b11049版本只改了一件小事:让test-llama-archs测试脚本自己生成一份虚拟测试词表,不再依赖真实模型文件,方便在缺少词表的情况下跑通架构相关测试。

这不是模型能力更新,也不是推理性能优化,主要影响的是llama.cpp的构建验证和CI流程。

普通用户不需要为此升级;如果你在打包或移植llama.cpp、需要快速验证某个平台能否正常启动,直接下载对应预编译包更省事。

macOS Apple Silicon的KleidiAI加速版本和openEuler平台构建被标记为DISABLED,说明这些路径当前不参与发布,相关平台的用户仍需用通用版本或自行编译。

llama.cpp发布b11049版本。该版本的核心变更是为test-llama-archs生成虚拟测试词表(pull request #29084),提交中标注Assisted-by: pi:llama.cpp/DeepSeek-V4-Flash-Vision-Exp。

b11049变更内容与测试方式

本次发布的主要改动是让test-llama-archs生成dummy test vocab,即测试用的虚拟词表,用于架构测试流程。提交信息将这一改动对应到PR #29084。

发布说明没有提供该测试的具体运行方式、覆盖的模型架构列表或性能数据,因此这些细节无法从来源确认。

发布平台与后端覆盖范围

b11049按平台提供预编译包。macOS/iOS侧包括macOS Apple Silicon(arm64)、macOS Intel(x64)和iOS XCFramework;其中macOS Apple Silicon的KleidiAI加速版本被标记为DISABLED,指向PR #23780。

Linux侧提供Ubuntu x64、arm64、s390x的CPU构建,以及Vulkan(x64/arm64)、CUDA 12.8(x64)、CUDA 13.3(x64/arm64,含对应cudart库)、ROCm 10.0(x64)、OpenVINO 2026.4(x64)和SYCL FP32/FP16(x64)。

Windows侧提供x64与arm64的CPU构建、arm64的OpenCL Adreno构建、CUDA 12.4(x64)、CUDA 13.4(x64/arm64,含对应DLL)、Vulkan(x64)、OpenVINO 2026.4(x64)、SYCL(x64)和ROCm 10.0(x64)。

Android侧提供arm64 CPU构建。openEuler的x86与aarch64构建(310p、910b、ACL Graph)同样被标记为DISABLED,指向PR #23705。此外发布页还附带UI包。

信息来源

llama.cpp Releases原始来源