开源llama.cpp Releases·原文 2026年9月23日

llama.cpp发布b11105:Jinja模板语句执行改用const

这次构建的核心改动只有一行——把statement::execute和 ::visit标记为const;同时发布覆盖macOS、Windows、Linux、Android的预编译包,macOS的KleidiAI加速版和openEuler构建仍处于禁用状态。

AI解读:llama.cpp的b11105版本改动了Jinja模板引擎内部的一处签名:statement::execute和 ::visit改为const。这是代码质量层面的调整,不影响模型推理或模板渲染的结果。

发布包覆盖范围很广,从macOS(Apple Silicon和Intel)、iOS XCFramework,到Windows、Linux、Android,甚至包括Ubuntu s390x这种不常见的架构。

两个细节值得留意:macOS Apple Silicon的KleidiAI加速版仍被标记为DISABLED,openEuler全部构建也被禁用。如果你依赖这些特定构建,这个版本还不能用。

对日常用户来说,直接去下对应平台的压缩包即可,功能上和前一个构建没有可感知的差异;对下游开发者而言,const化只是源码层面的小改,不需要额外适配。

llama.cpp发布构建版本b11105,唯一代码改动是jinja模块:把statement::execute和statement::visit改为const,对应PR #29271。

与代码改动一起发布的,是一整套按平台拆分的预编译二进制包,涵盖macOS、iOS、Linux、Android、Windows和UI组件。

唯一代码改动:Jinja语句执行加const

提交信息显示本次改动来自PR #29271,标题为“jinja: use const for statement::execute and ::visit”。改动对象是llama.cpp源码中处理Jinja模板的statement类,将execute和visit两个方法标记为const。

这项改动不涉及Jinja模板的渲染逻辑、支持的语法或执行结果,属于接口约束层面的调整。

覆盖平台:从Apple Silicon到Ubuntu s390x、Android Snapdragon

发布的预编译包按操作系统和加速后端拆分。macOS/iOS方面提供Apple Silicon(arm64)、macOS Intel(x64)和iOS XCFramework。

Linux方面覆盖Ubuntu x64、arm64、s390x的CPU构建,以及Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32和FP16版本,另有面向Snapdragon的Linux arm64包(CPU、Adreno GPU、Hexagon NPU)。

Android提供arm64的CPU包和Snapdragon版(CPU、Adreno GPU、Hexagon NPU)。Windows提供x64和arm64的CPU包,以及CUDA 12.4、CUDA 13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0和arm64 OpenCL Adreno版本。此外还单独发布了UI包。

两项仍被禁用的构建

macOS Apple Silicon的KleidiAI加速版被标记为DISABLED,指向PR #23780。openEuler的全部构建也被标记为DISABLED,指向PR #23705,涉及openEuler x86的 310p、910b(ACL Graph)以及aarch64的对应版本。

这意味着依赖KleidiAI加速的macOS用户或openEuler环境的用户,在这个版本中仍拿不到对应的官方预编译包。

来源说明

以上信息均来自llama.cpp的b11105发布页面,该页面由GitHub Actions机器人自动生成,主要内容是下载链接列表,未附带性能数据或行为变化的描述。

信息来源

llama.cpp Releases原始来源