开源llama.cpp Releases·原文 2026年9月27日

llama.cpp b11212发布:无llguidance时语法错误改为抛异常而非中止进程

llama.cpp发布构建号b11212,唯一列出的代码改动是common模块在没有llguidance的情况下遇到语法错误时抛出异常,而不是直接abort;同一版本继续提供macOS、Linux、Windows、Android及多后端预编译包。

AI解读:这次更新只有一行代码改动值得留意:在没有llguidance时,语法处理出错不再直接让整个进程abort,而是抛出异常。对把llama.cpp嵌进自己程序的人来说,区别很实际——以前一个坏语法可能把宿主进程一起带走,现在调用方有机会捕获并处理。

预编译包覆盖的范围没有缩水,反而继续把同一构建号铺到macOS、iOS、Linux、Windows、Android和openEuler上,后端包括CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL以及Snapdragon的Adreno GPU和Hexagon NPU。真正会因此改变行为的,主要是依赖语法约束输出、又不开llguidance的集成方;普通本地推理用户基本无感。

还有一个细节值得注意:macOS Apple Silicon的KleidiAI加速构建和openEuler系列在这个版本里仍是DISABLED状态,说明这些路径还没恢复。也就是说,能升级不等于所有加速选项都可用,选包时得看清标签。

llama.cpp发布构建b11212。发布说明中列出的一项代码改动位于common模块:在没有llguidance的情况下遇到语法问题时,改为抛出异常,而不是调用abort中止进程(#29516,作者Adrien Gallouët)。

该版本同时发布了一批预编译产物,覆盖macOS/iOS、Linux、Android、Windows和openEuler,以及CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL、Snapdragon等不同后端。发布说明未提供各构建的性能或行为差异数据。

唯一列出的代码改动:语法错误不再abort

按发布说明,这次改动的范围是common模块:当环境中没有llguidance时,语法处理出错会抛出异常,取代此前的abort行为。提交号为 #29516,签署人Adrien Gallouët。

发布说明没有说明具体触发条件、异常类型,也没有给出改动前后的对比测试或影响面评估。

b11212预编译包矩阵

发布页按平台列出可下载产物,以下为发布说明中给出的分类。

  • macOS/iOS:macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework;其中macOS Apple Silicon的KleidiAI enabled版本标注为DISABLED。
  • Linux:Ubuntu x64/arm64/s390x(CPU)、Ubuntu x64/arm64(Vulkan)、Ubuntu x64(CUDA 12.8、CUDA 13.4,含对应CUDA运行库)、Ubuntu arm64(CUDA 13.4,含运行库)、Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO 2026.4)、Ubuntu x64(SYCL FP32、SYCL FP16)、Linux arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU)。
  • Android:arm64(CPU)、arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU),后者提供setup guide。
  • Windows:x64/arm64(CPU)、arm64(OpenCL Adreno)、x64与arm64(CUDA 12.4与CUDA 13.4,含DLL)、x64(Vulkan)、x64(OpenVINO 2026.4)、x64(SYCL)、x64(ROCm 10.0)。
  • openEuler:整个条目标注为DISABLED,其下列出的openEuler x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)均未提供。
  • UI:另有单独的llama-b11212-ui.tar.gz可下载。

信息来源

llama.cpp Releases原始来源