开源llama.cpp Releases·原文 2026年9月23日

llama.cpp发布b11110:为mtmd多模态模块加入多项健全性检查

llama.cpp版本b11110的更新内容是给mtmd加上多项sanity checks(拉取请求 #29276),同时照例提供macOS、Linux、Windows、Android等各平台预编译包。

AI解读:这次llama.cpp的b11110更新内容本身很窄:给mtmd模块补上若干项健全性检查(sanity checks),对应拉取请求 #29276。mtmd是llama.cpp里处理多模态输入的组件,加检查意味着让它在遇到异常输入或状态时更早暴露问题。

对使用者来说,真正要留意的是另一件事:b11110的预编译包覆盖了macOS、iOS、Linux、Windows、Android和openEuler,细分到不同GPU后端和CUDA版本。它没有宣布新模型支持或性能提升,因此除非你需要这次检查带来的行为变化,否则不必立刻升级。

另外有两处仍然处于关闭状态:macOS Apple Silicon的KleidiAI构建,以及openEuler构建,都标为DISABLED,并分别指向对应的拉取请求。真正要判断是否升级,还是得去看 #29276 的具体改动。

llama.cpp发布b11110版本,更新条目为“mtmd: add various sanity checks”,对应拉取请求 #29276,由github-actions[bot] 在llama.cpp Releases页面发布。发布说明没有展开这些检查的具体内容,只给出标题和拉取请求编号。

发布页同时列出了b11110的各平台预编译产物,包括macOS/iOS的macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework,Linux的Ubuntu x64/arm64/s390x(CPU)、Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16,以及Linux arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU)构建。

Android方面提供Android arm64(CPU)与Android arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU)两个包,并附Snapdragon设置指南。Windows方面提供x64与arm64的CPU构建、Windows arm64 OpenCL Adreno、CUDA 12.4/13.4的x64与CUDA 13.4 arm64、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0等版本,以及对应的CUDA运行时DLL。此外还提供UI包。

两处构建在b11110中仍为DISABLED

发布说明标注两项处于关闭状态:macOS Apple Silicon(arm64)的KleidiAI启用构建被标记为DISABLED,指向拉取请求 #23780;openEuler一项同样标为DISABLED,指向拉取请求 #23705。

openEuler原本列出的构建包括openEuler x86(310p)、openEuler x86(910b,ACL Graph)、openEuler aarch64(310p)、openEuler aarch64(910b,ACL Graph),在本版本中均未提供可下载产物。

信息来源

llama.cpp Releases原始来源